Picture for Mohammad Rostami

Mohammad Rostami

Should We Type or Talk to LLM Agents? A Comprehensive Study of Voice and Keyboard Input Perturbations

Add code
Aug 04, 2026
Viaarxiv icon

In-Context Collapse in Vision-Language Models and How to Mitigate it?

Add code
Aug 03, 2026
Viaarxiv icon

Can You Trust the Confidence? ConfBench for Vision-Language Models on Document Extraction

Add code
Aug 03, 2026
Viaarxiv icon

FlowBank: Query-Adaptive Agentic Workflows Optimization through Precompute-and-Reuse

Add code
Jun 09, 2026
Viaarxiv icon

What-If World: A Causal Benchmark for General World Models in Embodied Scenarios

Add code
May 26, 2026
Viaarxiv icon

Expert Personas Improve LLM Alignment but Damage Accuracy: Bootstrapping Intent-Based Persona Routing with PRISM

Add code
Mar 19, 2026
Viaarxiv icon

Semi-Supervised Masked Autoencoders: Unlocking Vision Transformer Potential with Limited Data

Add code
Jan 27, 2026
Viaarxiv icon

Finetune-Informed Pretraining Boosts Downstream Performance

Add code
Jan 27, 2026
Viaarxiv icon

CageDroneRF: A Large-Scale RF Benchmark and Toolkit for Drone Perception

Add code
Jan 06, 2026
Viaarxiv icon

TNG-CLIP:Training-Time Negation Data Generation for Negation Awareness of CLIP

Add code
May 24, 2025
Viaarxiv icon