Picture for Xiao Liu

Xiao Liu

School of Computer Science and Technology, Anhui University

StageWAM: Joint-Embedding Stage Prediction for World-Action Models in Robot Manipulation

Add code
Aug 14, 2026
Viaarxiv icon

G0.5: One Autoregressive Stream for Robot Reasoning and Action

Add code
Aug 12, 2026
Viaarxiv icon

JEPA-WAM: Stage-Level Joint-Embedding Prediction for World-Action Models in Robot Manipulation

Add code
Aug 11, 2026
Viaarxiv icon

TideRL: Boosting Agentic RL Goodput with Readiness-Aware Scheduling

Add code
Aug 11, 2026
Viaarxiv icon

SignLlama: Enhancing Gloss-free Sign Language Translation by Prioritizing Visual Features for LLMs

Add code
Aug 10, 2026
Viaarxiv icon

SAIN: Structure-Aware Interactive Navigation with Active Dialogue Grounding for Mobile Robot

Add code
Aug 10, 2026
Viaarxiv icon

LAVE: Latent Visual Evidence-Enhanced Planning for Video Tool-use Agents

Add code
Aug 05, 2026
Viaarxiv icon

Sign Language Question Answering: A New Task, Benchmark, and Baseline for Sign Language Understanding

Add code
Jul 30, 2026
Viaarxiv icon

The Second LoViF 2026 Challenge on Real-World All-in-One Image Restoration: Methods and Results

Add code
Jul 23, 2026
Viaarxiv icon

SoftNav: Injecting 3D Scene Tokens into VLMs for Embodied Navigation

Add code
Jul 16, 2026
Viaarxiv icon