Picture for Qihong Lin

Qihong Lin

ACRL: Adaptive Control of Training-Inference Discrepancy for Stable Reinforcement Learning

Add code
Jul 27, 2026
Viaarxiv icon

Rethinking Token-Level Credit Assignment in RLVR: A Polarity-Entropy Analysis

Add code
Apr 13, 2026
Viaarxiv icon