Picture for Yuan Lu

Yuan Lu

SkillGate: Training In-Policy Skill Selection in Long-Horizon Agents

Add code
Aug 19, 2026
Viaarxiv icon

StreamArena: Toward Continuous, Interactive, and Long-Horizon Agentic Streaming Video Understanding

Add code
Aug 06, 2026
Viaarxiv icon

Harness-R1: Learning to Edit Executable Runtime Harnesses from Agent Failure Trajectories

Add code
Aug 03, 2026
Viaarxiv icon

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation

Add code
Jul 30, 2026
Viaarxiv icon

Rubrics on Trial: Evolving Rubrics from a Single Query via Synthetic Pairwise Evidence

Add code
Jul 16, 2026
Viaarxiv icon

Unlocking In-Context Learning in Audio-Language Models from Decentralized Medical Audio

Add code
Jun 22, 2026
Viaarxiv icon

Uncertainty-Aware Reward Modeling for Stable RLHF

Add code
Jun 18, 2026
Viaarxiv icon

SafeRun: Enabling Determinism in LLM Planning for Running

Add code
Jun 08, 2026
Viaarxiv icon

MINDGAMES: A Live Arena for Evaluating Social and Strategic Reasoning in Multi-Agent LLMs

Add code
May 28, 2026
Viaarxiv icon

MMSkills: Towards Multimodal Skills for General Visual Agents

Add code
May 14, 2026
Viaarxiv icon