Picture for Salman Khan

Salman Khan

Department of Computer Vision, Mohamed bin Zayed University of Artificial Intelligence

ReACT-CLIP: Response-Aware Test-Time Defense for Vision--Language Models

Add code
Aug 02, 2026
Viaarxiv icon

Regime-Aware Physics-Guided Early Warning of Lithium-Ion Battery Thermal Runaway Using Thermo-Mechanical Signals

Add code
Jul 21, 2026
Viaarxiv icon

Simple Domain Generalization for Strong Pixel-Level Image Tampering Detection in Modern VLMs

Add code
Jul 20, 2026
Viaarxiv icon

Ground3D-LMM: Fine-Grained 3D Point Grounding and Spatial Reasoning with LMM

Add code
Jul 06, 2026
Viaarxiv icon

Recovering Cloud Microstructures with Cascaded Diffusion Inversion

Add code
Jul 06, 2026
Viaarxiv icon

SAB-LVLM: Significance-Aware Binarization for Large Vision-Language Models

Add code
Jul 02, 2026
Viaarxiv icon

Paying More Attention to Visual Tokens in Self-Evolving Large Multimodal Models

Add code
Jun 25, 2026
Viaarxiv icon

Ask, Solve, Generate: Self-Evolving Unified Multimodal Understanding and Generation via Self-Consistency Rewards

Add code
Jun 25, 2026
Viaarxiv icon

CORTEX: A Structured Reasoning Benchmark for Trustworthy 3D Chest CT MLLMs

Add code
Jun 25, 2026
Viaarxiv icon

FlexPooling with Simple Auxiliary Classifiers in Deep Networks

Add code
Jun 12, 2026
Viaarxiv icon