Picture for Yixiang Chen

Yixiang Chen

XEWorld: Can Action-Conditioned World Models Generalize to Unseen Robot Embodiments?

Add code
Aug 06, 2026
Viaarxiv icon

BridgeVLA++: A Data-Efficient, Generalizable, and Memory-Augmented Vision-Language-Action Framework for 3D Manipulation

Add code
Aug 05, 2026
Viaarxiv icon

Style over Substance: A Shortcut Audit of Emotion-Description Preference Evaluation

Add code
Jul 20, 2026
Viaarxiv icon

UESF-Bench: Benchmarking and Probing for Unified Embodied Seeking and Following

Add code
Jul 15, 2026
Viaarxiv icon

FlowWAM: Optical Flow as a Unified Action Representation for World Action Models

Add code
Jul 14, 2026
Viaarxiv icon

DIM-WAM: World-Action Modeling with Diverse Historical Event Memory

Add code
Jun 26, 2026
Viaarxiv icon

Improving Vision-Language-Action Model Fine-Tuning with Structured Stage and Keyframe Supervision

Add code
Jun 25, 2026
Viaarxiv icon

SKIP: Sparse Keyframe Interpolation Paradigm for Efficient Embodied World Models

Add code
May 30, 2026
Viaarxiv icon

Multi-View Video Diffusion Policy: A 3D Spatio-Temporal-Aware Video Action Model

Add code
Apr 03, 2026
Viaarxiv icon

BridgeV2W: Bridging Video Generation Models to Embodied World Models via Embodiment Masks

Add code
Feb 03, 2026
Viaarxiv icon