Speech Recognition


Speech recognition is the task of identifying words spoken aloud, analyzing the voice and language, and accurately transcribing the words.

Towards Quantifying Benchmark Optimization in ASR Models

Add code
Aug 20, 2026
Viaarxiv icon

A Speech Corpus for Mizo Automatic Speech Recognition: Whisper and SraVaani 1.0 Fine-Tuning with Morphology-Aware Evaluation

Add code
Aug 19, 2026
Viaarxiv icon

Understanding Multilingual Medical ASR Adaptation Through Layer-Wise Analysis

Add code
Aug 19, 2026
Viaarxiv icon

SpeechSense: A Paralinguistic-Focused Dataset for Fine-Grained Speech Sentiment Analysis

Add code
Aug 18, 2026
Viaarxiv icon

Cached LLM Probability Retrieval for Speech Recognition

Add code
Aug 17, 2026
Viaarxiv icon

Aslema at NADI 2026: Augmentation through Fewshot for SLU

Add code
Aug 19, 2026
Viaarxiv icon

Emotion Across Speech and Faces: Shared Affective Mechanisms in Multimodal Foundation Models

Add code
Aug 17, 2026
Viaarxiv icon

Navigating Speech Enhancement for Real-Time MRI: A Systematic Assessment of Signal Quality, Source Preservation, and Downstream Tasks

Add code
Aug 17, 2026
Viaarxiv icon

Unadapted Multilingual ASR on a Garrusi Kurdish Evaluation Set: A Common-Reference Staged Normalization Analysis

Add code
Aug 17, 2026
Viaarxiv icon

StreamHear: Domain-Adapted Pseudo-Labeling for Semi-Supervised Streaming Speech Recognition

Add code
Aug 13, 2026
Viaarxiv icon