Picture for Xunliang Cai

Xunliang Cai

Alphabetical order by last name

Beyond Final Scores: A Systematic Evaluation of Agents for Long-Horizon AI Research and Development

Add code
Aug 13, 2026
Viaarxiv icon

AgentOPSD: Recursive Self-Distillation for Agentic Reinforcement Learning

Add code
Aug 06, 2026
Viaarxiv icon

AFD-Ledger: Deployment Provisioning for Attention--FFN Disaggregation

Add code
Aug 05, 2026
Viaarxiv icon

LongCat Sparse Attention: Taming the Lightning via Streaming-aware Hierarchical Cross-Layer Indexing

Add code
Aug 03, 2026
Viaarxiv icon

Distill Where You Fail: Recovering Learning Signals of Negative RL-Groups from Adaptive Teacher Guidance

Add code
Aug 01, 2026
Viaarxiv icon

SAF-OPD: Stable Advantage Fusion for On-Policy Distillation

Add code
Jul 31, 2026
Viaarxiv icon

Contrastive Reinforced Policy Optimization via Privileged Self-Distillation

Add code
Jul 30, 2026
Viaarxiv icon

ClawTrack: Towards Trace-Level Evaluation and Improvement of Real-World Autonomous Agents

Add code
Jul 30, 2026
Viaarxiv icon

SkillRise: Agentic Reinforcement Learning for Cross-Task Skill Evolution

Add code
Jul 29, 2026
Viaarxiv icon

CAST: Game Solvers as Turn-Level Teachers for LLM Agents

Add code
Jul 28, 2026
Viaarxiv icon