Picture for Siyin Wang

Siyin Wang

WCM: A World Critic Model for Vision-Language-Action Reinforcement Learning

Add code
Jul 31, 2026
Viaarxiv icon

SALMONN-2: Advancing General-Purpose Hearing Abilities with Self-Supervised Representations

Add code
Jul 19, 2026
Viaarxiv icon

HiMe: Hierarchical Embodied Memory for Long-Horizon Vision-Language-Action Control

Add code
Jul 03, 2026
Viaarxiv icon

Learning to Move Before Learning to Do: Task-Agnostic pretraining for VLAs

Add code
Jul 02, 2026
Viaarxiv icon

Advancing Omnimodal Embodied Agents from Isolated Skills to Everyday Physical Autonomy

Add code
Jun 25, 2026
Viaarxiv icon

In-Context World Modeling for Robotic Control

Add code
Jun 25, 2026
Viaarxiv icon

Augmenting Dysarthric Speech Severity Assessment with MOS Supervision

Add code
Jun 17, 2026
Viaarxiv icon

Coarse-to-Control: Action-Token Planning for Vision-Language-Action Models

Add code
Jun 05, 2026
Viaarxiv icon

World Action Models: The Next Frontier in Embodied AI

Add code
May 12, 2026
Viaarxiv icon

SICL-AT: Another way to adapt Auditory LLM to low-resource task

Add code
Jan 26, 2026
Viaarxiv icon