Picture for Amritansh Mishra

Amritansh Mishra

Efficient Reinforcement Learning for Long-Horizon Tool-Use Agentic Tasks

Add code
Aug 11, 2026
Viaarxiv icon

On the Policy Gradient Foundations of Group Relative Policy Optimization: Credit Assignment, Gradient Sparsity, and Rank Collapse

Add code
Jun 28, 2026
Viaarxiv icon