Picture for Changti Wu

Changti Wu

SIEVE: Structure-Aware Data Selection for Imitation Learning with VLA Models

Add code
Jul 07, 2026
Viaarxiv icon

Human-as-Humanoid: Enabling Zero-Shot Humanoid Learning from Ego-Exo Human Videos with Human-Aligned Embodiments

Add code
Jun 30, 2026
Viaarxiv icon

RoboSemanticBench: Diagnosing Semantic Grounding in Action Prediction for VLA Models

Add code
Jun 01, 2026
Viaarxiv icon

IntentVLA: Short-Horizon Intent Modeling for Aliased Robot Manipulation

Add code
May 14, 2026
Viaarxiv icon

FrameSkip: Learning from Fewer but More Informative Frames in VLA Training

Add code
May 13, 2026
Viaarxiv icon

3D-Mix for VLA: A Plug-and-Play Module for Integrating VGGT-based 3D Information into Vision-Language-Action Models

Add code
Mar 25, 2026
Viaarxiv icon

ScalSelect: Scalable Training-Free Multimodal Data Selection for Efficient Visual Instruction Tuning

Add code
Feb 12, 2026
Viaarxiv icon

LangForce: Bayesian Decomposition of Vision Language Action Models via Latent Action Queries

Add code
Jan 27, 2026
Viaarxiv icon

BayesianVLA: Bayesian Decomposition of Vision Language Action Models via Latent Action Queries

Add code
Jan 21, 2026
Viaarxiv icon

TwinBrainVLA: Unleashing the Potential of Generalist VLMs for Embodied Tasks via Asymmetric Mixture-of-Transformers

Add code
Jan 20, 2026
Viaarxiv icon