Picture for Qi Gu

Qi Gu

AgentOPSD: Recursive Self-Distillation for Agentic Reinforcement Learning

Add code
Aug 06, 2026
Viaarxiv icon

SkillRise: Agentic Reinforcement Learning for Cross-Task Skill Evolution

Add code
Jul 29, 2026
Viaarxiv icon

CAST: Game Solvers as Turn-Level Teachers for LLM Agents

Add code
Jul 28, 2026
Viaarxiv icon

Finding the Evidence: Discovering Decision-Supporting Tokens for On-Policy Reasoning Distillation

Add code
Jun 22, 2026
Viaarxiv icon

MineExplorer: Evaluating Open-World Exploration of MLLM Agents in Minecraft

Add code
May 29, 2026
Viaarxiv icon

GUI-CIDER: Mid-training GUI Agents via Causal Internalization and Density-aware Exemplar Reselection

Add code
May 27, 2026
Viaarxiv icon

Skill0.5: Joint Skill Internalization and Utilization for Out-of-Distribution Generalization in Agentic Reinforcement Learning

Add code
May 27, 2026
Viaarxiv icon

Learning to Act under Noise: Enhancing Agent Robustness via Noisy Environments

Add code
May 26, 2026
Viaarxiv icon

VitaBench 2.0: Evaluating Personalized and Proactive Agents in Long-Term User Interactions

Add code
May 26, 2026
Viaarxiv icon

When to Stop Reusing: Dynamic Gradient Gating for Sample-Efficient RLVR

Add code
May 19, 2026
Viaarxiv icon