Picture for Hao Cheng

Hao Cheng

MSEditor: Toward Consistent Multi-Shot Video Editing

Add code
Aug 18, 2026
Viaarxiv icon

RISE: Roadside Infrastructure Sequence Understanding across 3D Tracking and Structured Vision-Language Reasoning

Add code
Aug 17, 2026
Viaarxiv icon

Self-Boosting Vision-Language Models with Noisy Student On-Policy Self-Distillation

Add code
Jul 25, 2026
Viaarxiv icon

OpenForgeRL: Train Harness-native Agents in Any Environment

Add code
Jul 24, 2026
Viaarxiv icon

Histopathological Spectrum-Guided Prostate Stratification via Segmentation-Assisted Diagnostic Transformer

Add code
Jul 19, 2026
Viaarxiv icon

TRACE: Turn-level Reward Assignment via Credit Estimation for Long-Horizon Agents

Add code
Jul 15, 2026
Viaarxiv icon

Open-AoE: An Open Egocentric Manipulation Dataset and Toolchain for Embodied Learning

Add code
Jul 15, 2026
Viaarxiv icon

UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation

Add code
Jul 06, 2026
Viaarxiv icon

Learning Robot Visual Navigation in Crowds via Intention-Aware Scene Representations

Add code
Jun 24, 2026
Viaarxiv icon

LEDGER: Scaling Agentic Document Editing with Dependency-aware Graph Retrieval

Add code
Jun 19, 2026
Viaarxiv icon