Picture for Yueqing Sun

Yueqing Sun

AgentOPSD: Recursive Self-Distillation for Agentic Reinforcement Learning

Add code
Aug 06, 2026
Viaarxiv icon

Distill Where You Fail: Recovering Learning Signals of Negative RL-Groups from Adaptive Teacher Guidance

Add code
Aug 01, 2026
Viaarxiv icon

SkillRise: Agentic Reinforcement Learning for Cross-Task Skill Evolution

Add code
Jul 29, 2026
Viaarxiv icon

CAST: Game Solvers as Turn-Level Teachers for LLM Agents

Add code
Jul 28, 2026
Viaarxiv icon

Finding the Evidence: Discovering Decision-Supporting Tokens for On-Policy Reasoning Distillation

Add code
Jun 22, 2026
Viaarxiv icon

MineExplorer: Evaluating Open-World Exploration of MLLM Agents in Minecraft

Add code
May 29, 2026
Viaarxiv icon

MAP: A Map-then-Act Paradigm for Long-Horizon Interactive Agent Reasoning

Add code
May 13, 2026
Viaarxiv icon

$V_{0.5}$: Generalist Value Model as a Prior for Sparse RL Rollouts

Add code
Mar 11, 2026
Viaarxiv icon

TopoCurate:Modeling Interaction Topology for Tool-Use Agent Training

Add code
Mar 02, 2026
Viaarxiv icon

ScaleEnv: Scaling Environment Synthesis from Scratch for Generalist Interactive Tool-Use Agent Training

Add code
Feb 06, 2026
Viaarxiv icon