Picture for Huatong Song

Huatong Song

ClawGym II: Exploring Black-Box RL on Agent Harness

Add code
Aug 17, 2026
Viaarxiv icon

Evo-Bench: Can Language Models Improve Agent Harness?

Add code
Aug 11, 2026
Viaarxiv icon

Nanbeige4.2-3B: Unlocking Agentic Capabilities in a Compact Model

Add code
Jul 27, 2026
Viaarxiv icon

BeyondSWE: Can Current Code Agent Survive Beyond Single-Repo Bug Fixing?

Add code
Mar 03, 2026
Viaarxiv icon

SWE-Master: Unleashing the Potential of Software Engineering Agents via Post-Training

Add code
Feb 03, 2026
Viaarxiv icon

SWE-World: Building Software Engineering Agents in Docker-Free Environments

Add code
Feb 03, 2026
Viaarxiv icon

LLM-in-Sandbox Elicits General Agentic Intelligence

Add code
Jan 22, 2026
Viaarxiv icon

SimpleDeepSearcher: Deep Information Seeking via Web-Powered Reasoning Trajectory Synthesis

Add code
May 22, 2025
Figure 1 for SimpleDeepSearcher: Deep Information Seeking via Web-Powered Reasoning Trajectory Synthesis
Figure 2 for SimpleDeepSearcher: Deep Information Seeking via Web-Powered Reasoning Trajectory Synthesis
Figure 3 for SimpleDeepSearcher: Deep Information Seeking via Web-Powered Reasoning Trajectory Synthesis
Figure 4 for SimpleDeepSearcher: Deep Information Seeking via Web-Powered Reasoning Trajectory Synthesis
Viaarxiv icon

R1-Searcher++: Incentivizing the Dynamic Knowledge Acquisition of LLMs via Reinforcement Learning

Add code
May 22, 2025
Viaarxiv icon

R1-Searcher: Incentivizing the Search Capability in LLMs via Reinforcement Learning

Add code
Mar 07, 2025
Figure 1 for R1-Searcher: Incentivizing the Search Capability in LLMs via Reinforcement Learning
Figure 2 for R1-Searcher: Incentivizing the Search Capability in LLMs via Reinforcement Learning
Figure 3 for R1-Searcher: Incentivizing the Search Capability in LLMs via Reinforcement Learning
Figure 4 for R1-Searcher: Incentivizing the Search Capability in LLMs via Reinforcement Learning
Viaarxiv icon