Picture for Lanqing Hong

Lanqing Hong

InSight-doc: Agentic Visual Perception for Long-Document Understanding

Add code
Aug 11, 2026
Viaarxiv icon

AsySplat: Efficient Asymmetric 3D Gaussian Splatting for Long-Sequence Scene Modeling

Add code
Jul 13, 2026
Viaarxiv icon

StainFlow: Entity-Stain Tracking and Evidence Linking for Process Rewards in GUI Agents

Add code
Jun 05, 2026
Viaarxiv icon

MIRAGE: Mobile Agents with Implicit Reasoning and Generative World Models

Add code
Jun 03, 2026
Viaarxiv icon

Speech-Omni-Lite: Portable Speech Interfaces for Vision-Language Models

Add code
Mar 10, 2026
Viaarxiv icon

VGGT-Det: Mining VGGT Internal Priors for Sensor-Geometry-Free Multi-View Indoor 3D Object Detection

Add code
Mar 01, 2026
Viaarxiv icon

AEQ-Bench: Measuring Empathy of Omni-Modal Large Models

Add code
Jan 15, 2026
Viaarxiv icon

InSight-o3: Empowering Multimodal Foundation Models with Generalized Visual Search

Add code
Dec 21, 2025
Viaarxiv icon

Developing a Grounded View of AI

Add code
Nov 18, 2025
Viaarxiv icon

ECCV 2024 W-CODA: 1st Workshop on Multimodal Perception and Comprehension of Corner Cases in Autonomous Driving

Add code
Jul 02, 2025
Figure 1 for ECCV 2024 W-CODA: 1st Workshop on Multimodal Perception and Comprehension of Corner Cases in Autonomous Driving
Viaarxiv icon