Picture for Tongtong Cao

Tongtong Cao

Faster-WAM: Do World Action Models Need Deep Action Modules?

Add code
Aug 03, 2026
Viaarxiv icon

RoboHarness: Memory-Driven Orchestration of Heterogeneous Robot Policies for Long-Horizon Planning

Add code
Jul 20, 2026
Viaarxiv icon

Anticipate Before Acting: Future-State-Conditioned Vision-Language Navigation

Add code
Jul 20, 2026
Viaarxiv icon

KAM-WM: Kinematic Affordance Maps from Latent World Models for Robot Manipulation

Add code
Jul 06, 2026
Viaarxiv icon

Decoupling Semantics and Geometric Grounding: Spatial Visual Prompts for Language-Conditioned Imitation Learning

Add code
Jun 24, 2026
Viaarxiv icon

Uncertainty-Aware Gaussian Map for Vision-Language Navigation

Add code
May 26, 2026
Viaarxiv icon

RePO-VLA: Recovery-Driven Policy Optimization for Vision-Language-Action Models

Add code
May 10, 2026
Viaarxiv icon

Anticipation-VLA: Solving Long-Horizon Embodied Tasks via Anticipation-based Subgoal Generation

Add code
May 03, 2026
Viaarxiv icon

Efficient Camera Pose Augmentation for View Generalization in Robotic Policy Learning

Add code
Mar 31, 2026
Viaarxiv icon

Do World Action Models Generalize Better than VLAs? A Robustness Study

Add code
Mar 23, 2026
Viaarxiv icon