Picture for Yan Ding

Yan Ding

InternVLA-A1.5: Unifying Understanding, Latent Foresight, and Action for Compositional Generalization

Add code
Jul 06, 2026
Viaarxiv icon

One-to-Two Acting: A Novel Framework for Single-arm Agent Action Expansion to Dual Arms

Add code
Jun 18, 2026
Viaarxiv icon

A Scalable Embodied Intelligence Platform for Seamless Real-to-Sim-to-Real Transfer of Household Mobile Manipulation Tasks

Add code
Jun 17, 2026
Viaarxiv icon

UMI-Bench 1.0: An Open and Reproducible Real-World Benchmark for Tabletop Robotic Manipulation with UMI Data

Add code
Jun 09, 2026
Viaarxiv icon

EgoAERO: Learning Dexterous Manipulation from a Single Egocentric Video without Object Assets

Add code
Jun 06, 2026
Viaarxiv icon

VISTA: Vision-Grounded and Physics-Validated Adaptation of UMI data for VLA Training

Add code
Jun 04, 2026
Viaarxiv icon

GSAM: A Generalizable and Safe Robotic Framework for Articulated Object Manipulation

Add code
May 29, 2026
Viaarxiv icon

A-IO: Adaptive Inference Orchestration for Memory-Bound NPUs

Add code
Apr 10, 2026
Viaarxiv icon

Relaxed Triangle Inequality for Kullback-Leibler Divergence Between Multivariate Gaussian Distributions

Add code
Jan 31, 2026
Viaarxiv icon

AsyncVLA: Asynchronous Flow Matching for Vision-Language-Action Models

Add code
Nov 18, 2025
Figure 1 for AsyncVLA: Asynchronous Flow Matching for Vision-Language-Action Models
Figure 2 for AsyncVLA: Asynchronous Flow Matching for Vision-Language-Action Models
Figure 3 for AsyncVLA: Asynchronous Flow Matching for Vision-Language-Action Models
Figure 4 for AsyncVLA: Asynchronous Flow Matching for Vision-Language-Action Models
Viaarxiv icon