Picture for Zeshang Li

Zeshang Li

Towards Enhancing 3D Spatial Reasoning in Medical Multimodal Large Language Models

Add code
Jul 15, 2026
Viaarxiv icon

GEASS: Training-Free Caption Steering for Hallucination Mitigation in Vision-Language Models

Add code
May 03, 2026
Viaarxiv icon