Picture for Aditi Raghunathan

Aditi Raghunathan

Posterior Refinement: Fast Language Generation via Any-Order Flow Maps

Add code
Jun 23, 2026
Viaarxiv icon

Natively Unlearnable Large Language Models

Add code
Jun 11, 2026
Viaarxiv icon

Hardening Agent Benchmarks with Adversarial Hacker-Fixer Loops

Add code
Jun 08, 2026
Viaarxiv icon

Self-Trained Verification for Training- and Test-Time Self-Improvement

Add code
May 28, 2026
Viaarxiv icon

Understanding and Mitigating Premature Confidence for Better LLM Reasoning

Add code
May 23, 2026
Viaarxiv icon

Base Models Look Human To AI Detectors

Add code
May 19, 2026
Viaarxiv icon

Early Data Exposure Improves Robustness to Subsequent Fine-Tuning

Add code
May 12, 2026
Viaarxiv icon

Annotations Mitigate Post-Training Mode Collapse

Add code
May 11, 2026
Viaarxiv icon

Sharpness-Aware Pretraining Mitigates Catastrophic Forgetting

Add code
May 04, 2026
Viaarxiv icon

Terminal Wrench: A Dataset of 331 Reward-Hackable Environments and 3,632 Exploit Trajectories

Add code
Apr 19, 2026
Viaarxiv icon