Picture for Weize Li

Weize Li

ABot-N1: Toward a General Visual Language Navigation Foundation Model

Add code
Jul 14, 2026
Viaarxiv icon

VT-WAM: Visual-Tactile World Action Model for Contact-Rich Manipulation

Add code
Jul 02, 2026
Viaarxiv icon

VistaBot: View-Robust Robot Manipulation via Spatiotemporal-Aware View Synthesis

Add code
Apr 23, 2026
Viaarxiv icon

PokeVLA: Empowering Pocket-Sized Vision-Language-Action Model with Comprehensive World Knowledge Guidance

Add code
Apr 22, 2026
Viaarxiv icon

Goal2Skill: Long-Horizon Manipulation with Adaptive Planning and Reflection

Add code
Apr 15, 2026
Viaarxiv icon

OmniVTA: Visuo-Tactile World Modeling for Contact-Rich Robotic Manipulation

Add code
Mar 19, 2026
Viaarxiv icon

World In Your Hands: A Large-Scale and Open-source Ecosystem for Learning Human-centric Manipulation in the Wild

Add code
Dec 30, 2025
Viaarxiv icon

Taming VR Teleoperation and Learning from Demonstration for Multi-Task Bimanual Table Service Manipulation

Add code
Aug 21, 2025
Figure 1 for Taming VR Teleoperation and Learning from Demonstration for Multi-Task Bimanual Table Service Manipulation
Figure 2 for Taming VR Teleoperation and Learning from Demonstration for Multi-Task Bimanual Table Service Manipulation
Figure 3 for Taming VR Teleoperation and Learning from Demonstration for Multi-Task Bimanual Table Service Manipulation
Figure 4 for Taming VR Teleoperation and Learning from Demonstration for Multi-Task Bimanual Table Service Manipulation
Viaarxiv icon

PosePilot: Steering Camera Pose for Generative World Models with Self-supervised Depth

Add code
May 03, 2025
Viaarxiv icon

CPAny: Couple With Any Encoder to Refer Multi-Object Tracking

Add code
Mar 10, 2025
Viaarxiv icon