Picture for Srikanth Madikeri

Srikanth Madikeri

The Visual Bottleneck: Sparse-Frame Adaptation of MLLMs for Joint Spatial-Temporal Video Grounding

Add code
Jul 27, 2026
Viaarxiv icon

How to Leverage Synthetic Speech for LLM-Based ASR Systems?

Add code
Jun 27, 2026
Viaarxiv icon

Distilling Conversations: Abstract Compression of Conversational Audio Context for LLM-based ASR

Add code
Mar 27, 2026
Viaarxiv icon

TidyVoice 2026 Challenge Evaluation Plan

Add code
Jan 29, 2026
Viaarxiv icon

Reducing Prompt Sensitivity in LLM-based Speech Recognition Through Learnable Projection

Add code
Jan 28, 2026
Viaarxiv icon

Text-only adaptation in LLM-based ASR through text denoising

Add code
Jan 28, 2026
Viaarxiv icon

Spoofing-Aware Speaker Verification via Wavelet Prompt Tuning and Multi-Model Ensembles

Add code
Jan 24, 2026
Viaarxiv icon

TidyVoice: A Curated Multilingual Dataset for Speaker Verification Derived from Common Voice

Add code
Jan 22, 2026
Viaarxiv icon

Adaptive Multimodal Person Recognition: A Robust Framework for Handling Missing Modalities

Add code
Dec 16, 2025
Viaarxiv icon

SDialog: A Python Toolkit for End-to-End Agent Building, User Simulation, Dialog Generation, and Evaluation

Add code
Dec 12, 2025
Viaarxiv icon