speech recognition


Speech recognition is the task of identifying words spoken aloud, analyzing the voice and language, and accurately transcribing the words.

Dziri Voicebot: An End-to-End Low-Resource Speech-to-Speech Conversational System for Algerian Dialect

Add code
Jun 24, 2026
Viaarxiv icon

Systematic Study of Dysarthric Speech Recognition: Spectral Features and Acoustic Models

Add code
Jun 18, 2026
Viaarxiv icon

DASH: Dual-View Self-Distillation with Multi-Layer Hidden Representations for Robust Speech Recognition

Add code
Jun 17, 2026
Viaarxiv icon

Scaling Audio Models Efficiently: A Joint Study of Compute Constraints and Optimization Behavior

Add code
Jun 22, 2026
Viaarxiv icon

EmotionAI: A Privacy-Preserving Computational Intelligence Pipeline for Speech-Emotion-Grounded Conversational Analysis

Add code
Jun 22, 2026
Viaarxiv icon

HALAS: A Human-Annotated Dataset of Hallucinations of Modern ASR Systems

Add code
Jun 22, 2026
Viaarxiv icon

Layer-wise Probing of wav2vec 2.0 and Whisper for Consonant Cluster Reduction in African American English

Add code
Jun 22, 2026
Viaarxiv icon

Non-Autoregressive Minimum Bayes' Risk Decoding for Fast Speech Recognition

Add code
Jun 16, 2026
Viaarxiv icon

Audio--Image Alignment as a Continued-Pretraining Stage Improves Low-Resource ASR

Add code
Jun 23, 2026
Viaarxiv icon

Backdoor Attacks on Speech Emotion Recognition via TTS-Generated Poisoning

Add code
Jun 19, 2026
Viaarxiv icon