Picture for Xinrui Shi

Xinrui Shi

HAT-4D: Lifting Monocular Video for 4D Multi-Object Interactions via Human-Agent Collaboration

Add code
Jun 26, 2026
Viaarxiv icon

DRScaffold: Boosting Dense-Scene Reasoning in Lightweight Vision Language Models

Add code
May 25, 2026
Viaarxiv icon