Picture for Longteng Guo

Longteng Guo

Institute of Automation, Chinese Academy of Sciences, School of Artificial Intelligence, University of Chinese Academy of Sciences

World Tokens: Enhancing Embodied Policies with Training-Time World Modeling

Add code
Aug 10, 2026
Viaarxiv icon

NeuPAT: Neuron-aware Plasticity Allocation Tuning for Language-Preserving MLLMs

Add code
Aug 08, 2026
Viaarxiv icon

AtlasVLA: Persistent World-Ego State Modeling for Vision-Language-Action Models

Add code
Aug 07, 2026
Viaarxiv icon

TimeThink: Reasoning with Time for Video LLMs

Add code
Jul 06, 2026
Viaarxiv icon

SurveilNav: Collaborative Object Goal Navigation with Robot and Surveillance System

Add code
Jun 23, 2026
Viaarxiv icon

NavWM: A Unified Navigation World Model for Foresight-Driven Planning

Add code
Jun 23, 2026
Viaarxiv icon

VeriSpace: Spatially Grounded Action Verification for Vision-Language-Action Models

Add code
Jun 09, 2026
Viaarxiv icon

LongSpace: Exploring Long-Horizon Spatial Memory from Perception to Recall in Video

Add code
Jun 04, 2026
Viaarxiv icon

Can MLLMs Reason Beyond Language? VisReason: A Comprehensive Benchmark for Vision-Centric Reasoning

Add code
May 25, 2026
Viaarxiv icon

Semantic-Enriched Latent Visual Reasoning

Add code
May 19, 2026
Viaarxiv icon