Picture for Zihui Gao

Zihui Gao

RGB-D Video Generation for Improving Human-to-Robot Object Handover Prediction

Add code
Aug 13, 2026
Viaarxiv icon

Sekai2: From World Exploration to Interactive World Modeling

Add code
Aug 11, 2026
Viaarxiv icon

WISERouter: LLM Routing with Workload Budget Constraint

Add code
Jul 26, 2026
Viaarxiv icon

AlayaWorld: Interactive Long-Horizon World Modeling -- Full Technical Report

Add code
Jul 20, 2026
Viaarxiv icon

AlayaWorld: Long-Horizon and Playable Video World Generation

Add code
Jul 07, 2026
Viaarxiv icon

Scalable Adaptation of 3D Geometric Foundation Models via Weak Supervision from Internet Video

Add code
Feb 08, 2026
Viaarxiv icon

WiseAD: Knowledge Augmented End-to-End Autonomous Driving with Vision-Language Model

Add code
Dec 13, 2024
Figure 1 for WiseAD: Knowledge Augmented End-to-End Autonomous Driving with Vision-Language Model
Figure 2 for WiseAD: Knowledge Augmented End-to-End Autonomous Driving with Vision-Language Model
Figure 3 for WiseAD: Knowledge Augmented End-to-End Autonomous Driving with Vision-Language Model
Figure 4 for WiseAD: Knowledge Augmented End-to-End Autonomous Driving with Vision-Language Model
Viaarxiv icon