Picture for Xiuyi Lou

Xiuyi Lou

When Implausible Tokens Get Reinforced: Tail-Aware Credit Calibration for LLM Reinforcement Learning

Add code
Jul 08, 2026
Viaarxiv icon

Learning at the Right Pace: Adaptive Data Scheduling Improves LLM Reinforcement Learning

Add code
Jun 21, 2026
Viaarxiv icon