Picture for Gabriel Stanovsky

Gabriel Stanovsky

When Reranking Hurts: Uncertainty-Based Gating for Few-Shot Reranking

Add code
Jul 01, 2026
Viaarxiv icon

Can LLM Agents Infer World Models? Evidence from Agentic Automata Learning

Add code
Jun 15, 2026
Viaarxiv icon

Extending Item Response Theory for Efficient and Meaningful Multilingual Evaluation

Add code
Jun 14, 2026
Viaarxiv icon

From Feelings to Metrics: Understanding and Formalizing How Users Vibe-Test LLMs

Add code
Apr 16, 2026
Viaarxiv icon

Growing Pains: Extensible and Efficient LLM Benchmarking Via Fixed Parameter Calibration

Add code
Apr 14, 2026
Viaarxiv icon

ScheMatiQ: From Research Question to Structured Data through Interactive Schema Discovery

Add code
Apr 10, 2026
Viaarxiv icon

Beyond Memorization: Distinguishing between Reductive and Epistemic Reasoning in LLMs using Classic Logic Puzzles

Add code
Mar 22, 2026
Viaarxiv icon

Leveraging Digitized Newspapers to Collect Summarization Data in Low-Resource Languages

Add code
Nov 18, 2025
Viaarxiv icon

Planted in Pretraining, Swayed by Finetuning: A Case Study on the Origins of Cognitive Biases in LLMs

Add code
Jul 09, 2025
Figure 1 for Planted in Pretraining, Swayed by Finetuning: A Case Study on the Origins of Cognitive Biases in LLMs
Figure 2 for Planted in Pretraining, Swayed by Finetuning: A Case Study on the Origins of Cognitive Biases in LLMs
Figure 3 for Planted in Pretraining, Swayed by Finetuning: A Case Study on the Origins of Cognitive Biases in LLMs
Figure 4 for Planted in Pretraining, Swayed by Finetuning: A Case Study on the Origins of Cognitive Biases in LLMs
Viaarxiv icon

Time to Talk: LLM Agents for Asynchronous Group Communication in Mafia Games

Add code
Jun 05, 2025
Viaarxiv icon