Picture for Jiahui Fu

Jiahui Fu

ViSTR-Bench: Can MLLMs Reason from Continuous Visual Cues in Dynamic Scenes?

Add code
Jul 23, 2026
Viaarxiv icon

Generative Lane Topology Reasoning via Autoregressive Model with Geometry Prior

Add code
Jun 30, 2026
Viaarxiv icon

Geometry-Guided 3D Visual Token Pruning for Video-Language Models

Add code
Apr 20, 2026
Viaarxiv icon

Show, Don't Tell: Detecting Novel Objects by Watching Human Videos

Add code
Mar 13, 2026
Viaarxiv icon

NovaPlan: Zero-Shot Long-Horizon Manipulation via Closed-Loop Video Language Planning

Add code
Feb 23, 2026
Viaarxiv icon

NovaFlow: Zero-Shot Manipulation via Actionable Flow from Generated Videos

Add code
Oct 09, 2025
Figure 1 for NovaFlow: Zero-Shot Manipulation via Actionable Flow from Generated Videos
Figure 2 for NovaFlow: Zero-Shot Manipulation via Actionable Flow from Generated Videos
Figure 3 for NovaFlow: Zero-Shot Manipulation via Actionable Flow from Generated Videos
Figure 4 for NovaFlow: Zero-Shot Manipulation via Actionable Flow from Generated Videos
Viaarxiv icon

V2X-PC: Vehicle-to-everything Collaborative Perception via Point Cluster

Add code
Mar 25, 2024
Figure 1 for V2X-PC: Vehicle-to-everything Collaborative Perception via Point Cluster
Figure 2 for V2X-PC: Vehicle-to-everything Collaborative Perception via Point Cluster
Figure 3 for V2X-PC: Vehicle-to-everything Collaborative Perception via Point Cluster
Figure 4 for V2X-PC: Vehicle-to-everything Collaborative Perception via Point Cluster
Viaarxiv icon

Eliminating Cross-modal Conflicts in BEV Space for LiDAR-Camera 3D Object Detection

Add code
Mar 12, 2024
Figure 1 for Eliminating Cross-modal Conflicts in BEV Space for LiDAR-Camera 3D Object Detection
Figure 2 for Eliminating Cross-modal Conflicts in BEV Space for LiDAR-Camera 3D Object Detection
Figure 3 for Eliminating Cross-modal Conflicts in BEV Space for LiDAR-Camera 3D Object Detection
Figure 4 for Eliminating Cross-modal Conflicts in BEV Space for LiDAR-Camera 3D Object Detection
Viaarxiv icon

NeuSE: Neural SE(3)-Equivariant Embedding for Consistent Spatial Understanding with Objects

Add code
Mar 13, 2023
Figure 1 for NeuSE: Neural SE(3)-Equivariant Embedding for Consistent Spatial Understanding with Objects
Figure 2 for NeuSE: Neural SE(3)-Equivariant Embedding for Consistent Spatial Understanding with Objects
Figure 3 for NeuSE: Neural SE(3)-Equivariant Embedding for Consistent Spatial Understanding with Objects
Figure 4 for NeuSE: Neural SE(3)-Equivariant Embedding for Consistent Spatial Understanding with Objects
Viaarxiv icon

Object as Query: Equipping Any 2D Object Detector with 3D Detection Ability

Add code
Jan 06, 2023
Figure 1 for Object as Query: Equipping Any 2D Object Detector with 3D Detection Ability
Figure 2 for Object as Query: Equipping Any 2D Object Detector with 3D Detection Ability
Figure 3 for Object as Query: Equipping Any 2D Object Detector with 3D Detection Ability
Figure 4 for Object as Query: Equipping Any 2D Object Detector with 3D Detection Ability
Viaarxiv icon