Picture for Di He

Di He

Designing Reinforcement Learning for Diffusion Models: A Unified Path-Space View

Add code
Aug 14, 2026
Viaarxiv icon

AREX: Towards a Recursively Self-Improving Agent for Deep Research

Add code
Jul 24, 2026
Viaarxiv icon

Muse: Representation Geometry of Muon Beyond Normalized Momentum

Add code
Jul 16, 2026
Viaarxiv icon

Parallel Rollout Approximation for Pixel-Space Autoregressive Image Generation

Add code
Jun 26, 2026
Viaarxiv icon

Ouroboros-Spatial: Closing the Data-Model Loop for Spatial Reasoning

Add code
Jun 10, 2026
Viaarxiv icon

One LR Doesn't Fit All: Heavy-Tail Guided Layerwise Learning Rates for LLMs

Add code
May 21, 2026
Viaarxiv icon

Quotient-Space Diffusion Models

Add code
Apr 23, 2026
Viaarxiv icon

Evaluation-driven Scaling for Scientific Discovery

Add code
Apr 21, 2026
Viaarxiv icon

In-Place Test-Time Training

Add code
Apr 07, 2026
Viaarxiv icon

AgentFactory: A Self-Evolving Framework Through Executable Subagent Accumulation and Reuse

Add code
Mar 18, 2026
Viaarxiv icon