Picture for Jiaguan Zhu

Jiaguan Zhu

SG-WAM: Text-Grounded and Spatial-aware Semantic Guidance for World-Action Models

Add code
Aug 09, 2026
Viaarxiv icon

Is Forward Prediction Enough? Physical State Grounding for JEPA World Models

Add code
Aug 07, 2026
Viaarxiv icon

Robust-WAM: Bridging Generative Pretraining and Semantic Foresight in World-Action Models

Add code
Aug 07, 2026
Viaarxiv icon

DyPES-VLA: Learning Shared Dynamics Priors and Embodiment-Specific Control for Cross-Embodiment Manipulation

Add code
Aug 06, 2026
Viaarxiv icon

S-VAM: Shortcut Video-Action Model by Self-Distilling Geometric and Semantic Foresight

Add code
Mar 17, 2026
Viaarxiv icon