Picture for Zhenhan Yin

Zhenhan Yin

WSA$_1$: a 3D-Centric World-Spatial-Action Model for Generalizable Robot Control

Add code
Jul 04, 2026
Viaarxiv icon

MiVLA: Towards Generalizable Vision-Language-Action Model with Human-Robot Mutual Imitation Pre-training

Add code
Dec 19, 2025
Viaarxiv icon