Picture for Hermann Ney

Hermann Ney

Machine Learning and Human Language Technology, RWTH Aachen University, AppTek

Gradient-Based Speech-to-Text Alignment for Any ASR Model: From CTC to Speech LLMs

Add code
Jul 07, 2026
Viaarxiv icon

Revisiting the Relation Between Language Model Perplexity and ASR Word Error Rate for Modern End-to-End Speech Recognition

Add code
Jul 06, 2026
Viaarxiv icon

Enhancing BEST-RQ Pseudo-Label Quality through Online Refinement for Automatic Speech Recognition

Add code
Jun 24, 2026
Viaarxiv icon

Diffusion Language Models for Speech Recognition

Add code
Apr 15, 2026
Viaarxiv icon

LLMs and Speech: Integration vs. Combination

Add code
Mar 16, 2026
Viaarxiv icon

Sequence-Level Unsupervised Training in Speech Recognition: A Theoretical Study

Add code
Mar 02, 2026
Viaarxiv icon

Reproducing and Dissecting Denoising Language Models for Speech Recognition

Add code
Dec 15, 2025
Viaarxiv icon

Dynamic Acoustic Model Architecture Optimization in Training for ASR

Add code
Jun 16, 2025
Viaarxiv icon

Regularizing Learnable Feature Extraction for Automatic Speech Recognition

Add code
Jun 11, 2025
Viaarxiv icon

Label-Context-Dependent Internal Language Model Estimation for CTC

Add code
Jun 06, 2025
Figure 1 for Label-Context-Dependent Internal Language Model Estimation for CTC
Figure 2 for Label-Context-Dependent Internal Language Model Estimation for CTC
Figure 3 for Label-Context-Dependent Internal Language Model Estimation for CTC
Viaarxiv icon