Picture for Pulkit Agrawal

Pulkit Agrawal

Dynamic Compression in Recurrent Networks

Add code
Aug 18, 2026
Viaarxiv icon

Learning More from Less: Reinforcement Learning from Hindsight

Add code
Jul 10, 2026
Viaarxiv icon

Prompt-Driven Exploration

Add code
Jul 09, 2026
Viaarxiv icon

What Matters When Cotraining Robot Manipulation Policies on Everyday Human Videos?

Add code
Jun 04, 2026
Viaarxiv icon

Fine-Tuning and Serving Gemma 4 31B on Google Cloud TPU: A Technical Comparison with GPU Baselines

Add code
May 25, 2026
Viaarxiv icon

Vector Policy Optimization: Training for Diversity Improves Test-Time Search

Add code
May 21, 2026
Viaarxiv icon

Tune to Learn: How Controller Gains Shape Robot Policy Learning

Add code
Apr 02, 2026
Viaarxiv icon

H2LooP Spark Preview: Continual Pretraining of Large Language Models for Low-Level Embedded Systems Code

Add code
Mar 11, 2026
Viaarxiv icon

Training Language Models via Neural Cellular Automata

Add code
Mar 09, 2026
Viaarxiv icon

Agile asymmetric multi-legged locomotion: contact planning via geometric mechanics and spin model duality

Add code
Feb 09, 2026
Viaarxiv icon