Picture for Jiabing Yang

Jiabing Yang

XEWorld: Can Action-Conditioned World Models Generalize to Unseen Robot Embodiments?

Add code
Aug 06, 2026
Viaarxiv icon

BridgeVLA++: A Data-Efficient, Generalizable, and Memory-Augmented Vision-Language-Action Framework for 3D Manipulation

Add code
Aug 05, 2026
Viaarxiv icon

Style over Substance: A Shortcut Audit of Emotion-Description Preference Evaluation

Add code
Jul 20, 2026
Viaarxiv icon

FlowWAM: Optical Flow as a Unified Action Representation for World Action Models

Add code
Jul 14, 2026
Viaarxiv icon

Improving Vision-Language-Action Model Fine-Tuning with Structured Stage and Keyframe Supervision

Add code
Jun 25, 2026
Viaarxiv icon

When Seeing Is Not Believing -- A Benchmark for Search-Grounded Video Misinformation Detection

Add code
Jun 02, 2026
Viaarxiv icon

SKIP: Sparse Keyframe Interpolation Paradigm for Efficient Embodied World Models

Add code
May 30, 2026
Viaarxiv icon

Multi-View Video Diffusion Policy: A 3D Spatio-Temporal-Aware Video Action Model

Add code
Apr 03, 2026
Viaarxiv icon

Beyond Closed-Pool Video Retrieval: A Benchmark and Agent Framework for Real-World Video Search and Moment Localization

Add code
Feb 10, 2026
Viaarxiv icon

PaperX: A Unified Framework for Multimodal Academic Presentation Generation with Scholar DAG

Add code
Feb 05, 2026
Viaarxiv icon