Picture for Datta Nimmaturi

Datta Nimmaturi

Predictable GRPO: A Closed-Form Model of Training Dynamics

Add code
Jul 01, 2026
Viaarxiv icon

Predictive Scaling Laws for Efficient GRPO Training of Large Reasoning Models

Add code
Jul 24, 2025
Figure 1 for Predictive Scaling Laws for Efficient GRPO Training of Large Reasoning Models
Figure 2 for Predictive Scaling Laws for Efficient GRPO Training of Large Reasoning Models
Figure 3 for Predictive Scaling Laws for Efficient GRPO Training of Large Reasoning Models
Figure 4 for Predictive Scaling Laws for Efficient GRPO Training of Large Reasoning Models
Viaarxiv icon