Picture for Yunzhong He

Yunzhong He

Rubric Dropout: A Simple Way to Mitigate Reward Hacking in Rubric-as-Reward RL

Add code
Aug 12, 2026
Viaarxiv icon

Model or Harness? An Interaction-Centric Taxonomy for Localizing Agent Failures

Add code
Jul 30, 2026
Viaarxiv icon

CRAFT: Clustering Rubrics to Diagnose Weak LLM Capabilities and Generate Targeted Fine-Tuning Data

Add code
Jul 17, 2026
Viaarxiv icon

APeB: Benchmarking Personalization Ability of Large Language Model Agents

Add code
Jul 03, 2026
Viaarxiv icon

SWE-INTERACT: Reimagining SWE Benchmarks as User-Driven Long-Horizon Coding Sessions

Add code
Jun 29, 2026
Viaarxiv icon

Rubric-Guided Self-Distillation: Post-Training Without Rubric Verifiers

Add code
Jun 10, 2026
Viaarxiv icon

Not Every Rubric Teaches Equally: Policy-Aware Rubric Rewards for RLVR

Add code
May 19, 2026
Viaarxiv icon

Reward Hacking in Rubric-Based Reinforcement Learning

Add code
May 12, 2026
Viaarxiv icon

Agentic Rubrics as Contextual Verifiers for SWE Agents

Add code
Jan 07, 2026
Viaarxiv icon

Audio MultiChallenge: A Multi-Turn Evaluation of Spoken Dialogue Systems on Natural Human Interaction

Add code
Dec 16, 2025
Figure 1 for Audio MultiChallenge: A Multi-Turn Evaluation of Spoken Dialogue Systems on Natural Human Interaction
Figure 2 for Audio MultiChallenge: A Multi-Turn Evaluation of Spoken Dialogue Systems on Natural Human Interaction
Figure 3 for Audio MultiChallenge: A Multi-Turn Evaluation of Spoken Dialogue Systems on Natural Human Interaction
Figure 4 for Audio MultiChallenge: A Multi-Turn Evaluation of Spoken Dialogue Systems on Natural Human Interaction
Viaarxiv icon