Picture for Guoyang Xia

Guoyang Xia

VANE: Reliable Test-Time Training for Vision-Language-Action Models via Future Visual Representation Prediction

Add code
Aug 12, 2026
Viaarxiv icon

VLAFlow: A Unified Training Framework for Vision-Language-Action Models via Co-training and Future Latent Alignment

Add code
Jul 02, 2026
Viaarxiv icon

Lngram: N-gram Conditional Memory in Latent Space

Add code
May 24, 2026
Viaarxiv icon

SMAR: Soft Modality-Aware Routing Strategy for MoE-based Multimodal Large Language Models Preserving Language Capabilities

Add code
Jun 06, 2025
Viaarxiv icon