Picture for Daman Arora

Daman Arora

Message Passing Enables Efficient Reasoning

Add code
Jul 01, 2026
Viaarxiv icon

Maximum Likelihood Reinforcement Learning

Add code
Feb 02, 2026
Viaarxiv icon

Shrinking the Variance: Shrinkage Baselines for Reinforcement Learning with Verifiable Rewards

Add code
Nov 05, 2025
Viaarxiv icon

SPEED-RL: Faster Training of Reasoning Models via Online Curriculum Learning

Add code
Jun 10, 2025
Figure 1 for SPEED-RL: Faster Training of Reasoning Models via Online Curriculum Learning
Figure 2 for SPEED-RL: Faster Training of Reasoning Models via Online Curriculum Learning
Figure 3 for SPEED-RL: Faster Training of Reasoning Models via Online Curriculum Learning
Figure 4 for SPEED-RL: Faster Training of Reasoning Models via Online Curriculum Learning
Viaarxiv icon

Training Language Models to Reason Efficiently

Add code
Feb 06, 2025
Viaarxiv icon

MASAI: Modular Architecture for Software-engineering AI Agents

Add code
Jun 17, 2024
Viaarxiv icon

GAR-meets-RAG Paradigm for Zero-Shot Information Retrieval

Add code
Oct 31, 2023
Viaarxiv icon

Learning and Leveraging Verifiers to Improve Planning Capabilities of Pre-trained Language Models

Add code
May 26, 2023
Viaarxiv icon

Have LLMs Advanced Enough? A Challenging Problem Solving Benchmark For Large Language Models

Add code
May 24, 2023
Viaarxiv icon