Picture for Ruiyi Ding

Ruiyi Ding

TEMPO: Makespan-Aware Expert-Parallel Load Balancing Across Memory- and Compute-Bound Regimes

Add code
Aug 14, 2026
Viaarxiv icon

JAGG: Jacobian-Aggregated Group Gradient for Efficient GRPO Training of Diffusion Models

Add code
Jul 25, 2026
Viaarxiv icon

AGG: Jacobian-Aggregated Group Gradient for Efficient GRPO Training of Diffusion Models

Add code
Jul 20, 2026
Viaarxiv icon

Meta-Cognitive Memory Policy Optimization for Long-Horizon LLM Agents

Add code
May 28, 2026
Viaarxiv icon

CFNN: Continued Fraction Neural Network

Add code
Mar 21, 2026
Viaarxiv icon

PRPO: Aligning Process Reward with Outcome Reward in Policy Optimization

Add code
Jan 13, 2026
Viaarxiv icon