Picture for Siddhant Bharadwaj

Siddhant Bharadwaj

Do Medical Vision Language Models Actually See? A Counterfactual Grounding Framework and Hard-Negative Contrastive Training for Visually-Reliant Medical VLMs

Add code
Jul 04, 2026
Viaarxiv icon

Spatial Reasoning is Not a Free Lunch: A Controlled Study on LLaVA

Add code
Mar 13, 2026
Viaarxiv icon

The Spatial Blindspot of Vision-Language Models

Add code
Jan 15, 2026
Viaarxiv icon

Adaptive Multi Scale Document Binarisation Using Vision Mamba

Add code
Oct 30, 2024
Figure 1 for Adaptive Multi Scale Document Binarisation Using Vision Mamba
Figure 2 for Adaptive Multi Scale Document Binarisation Using Vision Mamba
Figure 3 for Adaptive Multi Scale Document Binarisation Using Vision Mamba
Figure 4 for Adaptive Multi Scale Document Binarisation Using Vision Mamba
Viaarxiv icon