Picture for David Schlangen

David Schlangen

Don't Let Me Ask for It: LLMs Show Deficiencies in Active Multi-Turn Information Acquisition for Abductive Inference

Add code
Aug 04, 2026
Viaarxiv icon

Language Equality has a Price: A Systematic Investigation of Multi-turn LLM Performance for EU-24+

Add code
Aug 02, 2026
Viaarxiv icon

The Image Reconstruction Game: Drawing Common Ground Through Iterative Multimodal Dialogue

Add code
Jun 01, 2026
Viaarxiv icon

Multi-Turn Multi-Agent Dialogue for Collaborative Reconstruction Improves VLM Performance on Spatial Reasoning, But Only Barely

Add code
May 29, 2026
Viaarxiv icon

Order in the Evaluation Court: A Critical Analysis of NLG Evaluation Trends

Add code
Jan 12, 2026
Viaarxiv icon

Could the Road to Grounded, Neuro-symbolic AI be Paved with Words-as-Classifiers?

Add code
Jul 08, 2025
Viaarxiv icon

From Templates to Natural Language: Generalization Challenges in Instruction-Tuned LLMs for Spatial Reasoning

Add code
May 20, 2025
Figure 1 for From Templates to Natural Language: Generalization Challenges in Instruction-Tuned LLMs for Spatial Reasoning
Figure 2 for From Templates to Natural Language: Generalization Challenges in Instruction-Tuned LLMs for Spatial Reasoning
Figure 3 for From Templates to Natural Language: Generalization Challenges in Instruction-Tuned LLMs for Spatial Reasoning
Figure 4 for From Templates to Natural Language: Generalization Challenges in Instruction-Tuned LLMs for Spatial Reasoning
Viaarxiv icon

clem:todd: A Framework for the Systematic Benchmarking of LLM-Based Task-Oriented Dialogue System Realisations

Add code
May 08, 2025
Viaarxiv icon

Playpen: An Environment for Exploring Learning Through Conversational Interaction

Add code
Apr 11, 2025
Figure 1 for Playpen: An Environment for Exploring Learning Through Conversational Interaction
Figure 2 for Playpen: An Environment for Exploring Learning Through Conversational Interaction
Figure 3 for Playpen: An Environment for Exploring Learning Through Conversational Interaction
Figure 4 for Playpen: An Environment for Exploring Learning Through Conversational Interaction
Viaarxiv icon

Triangulating LLM Progress through Benchmarks, Games, and Cognitive Tests

Add code
Feb 20, 2025
Figure 1 for Triangulating LLM Progress through Benchmarks, Games, and Cognitive Tests
Figure 2 for Triangulating LLM Progress through Benchmarks, Games, and Cognitive Tests
Figure 3 for Triangulating LLM Progress through Benchmarks, Games, and Cognitive Tests
Figure 4 for Triangulating LLM Progress through Benchmarks, Games, and Cognitive Tests
Viaarxiv icon