Picture for Jingang Wang

Jingang Wang

Beyond Final Scores: A Systematic Evaluation of Agents for Long-Horizon AI Research and Development

Add code
Aug 13, 2026
Viaarxiv icon

Distilling Temporal Search and Reasoning: Evolving LLMs for Future Prediction via Harness-Assisted Efficient Data Synthesis

Add code
Jul 28, 2026
Viaarxiv icon

Co-Harness: Co-Evolving Harnesses and Model Weights for LLM Agents

Add code
Jul 17, 2026
Viaarxiv icon

ToFu: A White-Box, Token-Efficient Agent Harness for Researchers

Add code
Jul 13, 2026
Viaarxiv icon

Beyond Trajectory Imitation: Strategy-Guided Policy Optimization for LLM Reasoning

Add code
Jun 23, 2026
Viaarxiv icon

Dynamic Rollout Editing for Reducing Overthinking in RL-Trained Reasoning Models

Add code
Jun 16, 2026
Viaarxiv icon

HIPIF: Hierarchical Planning and Information Folding for Long-Horizon LLM Agent Learning

Add code
Jun 09, 2026
Viaarxiv icon

When Model Merging Breaks Routing: Training-Free Calibration for MoE

Add code
Jun 02, 2026
Viaarxiv icon

ATLAS: All-round Testing of Long-context Abilities across Scales

Add code
May 27, 2026
Viaarxiv icon

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance

Add code
May 21, 2026
Viaarxiv icon