Picture for Zehao Huang

Zehao Huang

Geometry-Grounded Unified 3D Perception for Autonomous Driving

Add code
Aug 13, 2026
Viaarxiv icon

ViSTR-Bench: Can MLLMs Reason from Continuous Visual Cues in Dynamic Scenes?

Add code
Jul 23, 2026
Viaarxiv icon

Generative Lane Topology Reasoning via Autoregressive Model with Geometry Prior

Add code
Jun 30, 2026
Viaarxiv icon

Geometry-Guided 3D Visual Token Pruning for Video-Language Models

Add code
Apr 20, 2026
Viaarxiv icon

Utonia: Toward One Encoder for All Point Clouds

Add code
Mar 03, 2026
Viaarxiv icon

Anchor3DLane++: 3D Lane Detection via Sample-Adaptive Sparse 3D Anchor Regression

Add code
Dec 22, 2024
Viaarxiv icon

MV2DFusion: Leveraging Modality-Specific Object Semantics for Multi-Modal 3D Detection

Add code
Aug 12, 2024
Viaarxiv icon

Enhancing 3D Lane Detection and Topology Reasoning with 2D Lane Priors

Add code
Jun 05, 2024
Figure 1 for Enhancing 3D Lane Detection and Topology Reasoning with 2D Lane Priors
Figure 2 for Enhancing 3D Lane Detection and Topology Reasoning with 2D Lane Priors
Figure 3 for Enhancing 3D Lane Detection and Topology Reasoning with 2D Lane Priors
Figure 4 for Enhancing 3D Lane Detection and Topology Reasoning with 2D Lane Priors
Viaarxiv icon

SparseFusion: Efficient Sparse Multi-Modal Fusion Framework for Long-Range 3D Perception

Add code
Mar 15, 2024
Figure 1 for SparseFusion: Efficient Sparse Multi-Modal Fusion Framework for Long-Range 3D Perception
Figure 2 for SparseFusion: Efficient Sparse Multi-Modal Fusion Framework for Long-Range 3D Perception
Figure 3 for SparseFusion: Efficient Sparse Multi-Modal Fusion Framework for Long-Range 3D Perception
Figure 4 for SparseFusion: Efficient Sparse Multi-Modal Fusion Framework for Long-Range 3D Perception
Viaarxiv icon

TSTTC: A Large-Scale Dataset for Time-to-Contact Estimation in Driving Scenarios

Add code
Sep 06, 2023
Viaarxiv icon