Picture for Matthias Bethge

Matthias Bethge

DeepGaze3.5-VL: Modeling Scanpaths via Autoregressive Token Prediction

Add code
Jul 02, 2026
Viaarxiv icon

DataComp-VLM: Improved Open Datasets for Vision-Language Models

Add code
Jun 30, 2026
Viaarxiv icon

QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents

Add code
Jun 30, 2026
Viaarxiv icon

RevengeBench: Reverse Engineering Code-Space Policies from Behavioral Experiments

Add code
Jun 24, 2026
Viaarxiv icon

Round-Trip Translation Reveals What Frontier Multilingual Benchmarks Miss

Add code
Apr 14, 2026
Viaarxiv icon

Personalizing Text-to-Image Generation to Individual Taste

Add code
Apr 08, 2026
Viaarxiv icon

PostTrainBench: Can LLM Agents Automate LLM Post-Training?

Add code
Mar 10, 2026
Viaarxiv icon

Intrinsic Credit Assignment for Long Horizon Interaction

Add code
Feb 12, 2026
Viaarxiv icon

MentisOculi: Revealing the Limits of Reasoning with Mental Imagery

Add code
Feb 02, 2026
Viaarxiv icon

Un-Attributability: Computing Novelty From Retrieval & Semantic Similarity

Add code
Oct 31, 2025
Viaarxiv icon