Picture for Lifeng Zhou

Lifeng Zhou

Latent World Models with Monotone Planning Costs for Image-Goal Navigation

Add code
Aug 10, 2026
Viaarxiv icon

TransGraspNet: Physically and Geometrically Consistent Manipulation of Transparent Labware

Add code
Jul 31, 2026
Viaarxiv icon

What's Hidden Matters: Identifying Planning-Critical Occluded Agents using Vision-Language Models

Add code
Jul 01, 2026
Viaarxiv icon

Threading Optimization for Vision-Language-Action Model Inference in Low-Cost Smart Agricultural Manipulation

Add code
May 31, 2026
Viaarxiv icon

ROG-Grasp: Root-Oriented Geometry for Robotic Grasping and Placement

Add code
May 30, 2026
Viaarxiv icon

GA3T: A Ground-Aerial Terrain Traversability Dataset for Heterogeneous Robot Teams in Unstructured Environments

Add code
May 07, 2026
Viaarxiv icon

VILAS: A VLA-Integrated Low-cost Architecture with Soft Grasping for Robotic Manipulation

Add code
May 03, 2026
Viaarxiv icon

Policy-Guided World Model Planning for Language-Conditioned Visual Navigation

Add code
Mar 26, 2026
Viaarxiv icon

IDSelect: A RL-Based Cost-Aware Selection Agent for Video-based Multi-Modal Person Recognition

Add code
Feb 22, 2026
Viaarxiv icon

CLAW: A Vision-Language-Action Framework for Weight-Aware Robotic Grasping

Add code
Sep 17, 2025
Viaarxiv icon