Picture for Shuai Shao

Shuai Shao

Harness-R1: Learning to Edit Executable Runtime Harnesses from Agent Failure Trajectories

Add code
Aug 03, 2026
Viaarxiv icon

From Single- to Cross-Document: Benchmarking Multi-Granularity Event Analysis of Large Language Models

Add code
Jul 30, 2026
Viaarxiv icon

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation

Add code
Jul 30, 2026
Viaarxiv icon

ACM: Agentic Context Management for Long Horizon Tasks

Add code
Jul 26, 2026
Viaarxiv icon

Clarus: Coordinating Autonomous Research Agents toward Web-Scale Scientific Collaboration

Add code
Jun 29, 2026
Viaarxiv icon

AgentDoG 1.5: A Lightweight and Scalable Alignment Framework for AI Agent Safety and Security

Add code
May 28, 2026
Viaarxiv icon

MMSkills: Towards Multimodal Skills for General Visual Agents

Add code
May 14, 2026
Viaarxiv icon

Rethinking Generalization in Reasoning SFT: A Conditional Analysis on Optimization, Data, and Model Capability

Add code
Apr 08, 2026
Viaarxiv icon

ATBench: A Diverse and Realistic Agent Trajectory Benchmark for Safety Evaluation and Diagnosis

Add code
Apr 08, 2026
Viaarxiv icon

OmniCamera: A Unified Framework for Multi-task Video Generation with Arbitrary Camera Control

Add code
Apr 07, 2026
Viaarxiv icon