Picture for Hangjun Ye

Hangjun Ye

What Matters for Latent Actions in Robot Learning

Add code
Aug 20, 2026
Viaarxiv icon

SpatioLM: Towards General Physical Spatial Intelligence in Vision-Language Models

Add code
Aug 03, 2026
Viaarxiv icon

Xiaomi-Robotics-1: Scaling Vision-Language-Action Models with over 100K Hours of Real-World Trajectories

Add code
Jul 22, 2026
Viaarxiv icon

GeoWorldAD: Geometry World Action Model for Autonomous Driving

Add code
Jul 20, 2026
Viaarxiv icon

Xiaomi-Robotics-U0: Unified Embodied Synthesis with World Foundation Model

Add code
Jul 13, 2026
Viaarxiv icon

UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation

Add code
Jul 06, 2026
Viaarxiv icon

Text-Driven 3D Indoor Scene Synthesis in Non-Manhattan Environments

Add code
Jul 02, 2026
Viaarxiv icon

FutureNav: Unified World-Action Modeling for Vision-and-Language Navigation

Add code
Jun 29, 2026
Viaarxiv icon

Pondering the Way: Spatial-perceiving World Action Model for Embodied Navigation

Add code
Jun 29, 2026
Viaarxiv icon

L2D2-GS: Learning to Densify for Feedforward Dynamic Gaussian Scene Reconstruction

Add code
Jun 28, 2026
Viaarxiv icon