Picture for Yongliang Shen

Yongliang Shen

AgentOPSD: Recursive Self-Distillation for Agentic Reinforcement Learning

Add code
Aug 06, 2026
Viaarxiv icon

SkillRise: Agentic Reinforcement Learning for Cross-Task Skill Evolution

Add code
Jul 29, 2026
Viaarxiv icon

Pass the Baton: Trajectory-Relayed On-Policy Distillation

Add code
Jul 28, 2026
Viaarxiv icon

VLA-Corrector: Lightweight Detect-and-Correct Inference for Adaptive Action Horizon

Add code
Jul 02, 2026
Viaarxiv icon

Perceive-to-Reason: Decoupling Perception and Reasoning for Fine-Grained Visual Reasoning

Add code
Jul 01, 2026
Viaarxiv icon

Beyond Rubrics: Exploration-Guided Evaluation Skills for Reward Modeling

Add code
Jun 05, 2026
Viaarxiv icon

Phun-Bench: Evaluating LLMs on Phonological Understanding in Chinese

Add code
Jun 05, 2026
Viaarxiv icon

Beyond Literal Translation: Evaluating Cultural Effectiveness in Social Media UGC

Add code
May 25, 2026
Viaarxiv icon

Self-Distilled Agentic Reinforcement Learning

Add code
May 14, 2026
Viaarxiv icon

Milestone-Guided Policy Learning for Long-Horizon Language Agents

Add code
May 07, 2026
Viaarxiv icon