Picture for Samuele Cornell

Samuele Cornell

Dissecting Sensitivity to Training Language in Self-Supervised Speech Learning Using Neural Audio Codec Tokens

Add code
Jul 28, 2026
Viaarxiv icon

ESPnet3: Infrastructure for Scalable Speech and Audio Research in the Foundation Model Era

Add code
Jun 20, 2026
Viaarxiv icon

Grounding Spoken LLMs in Multi-Speaker Audio via Diarization Conditioning

Add code
Jun 16, 2026
Viaarxiv icon

Exploiting Noise Inseparability for Weakly-Supervised Discriminative Speech Denoising Using Noisy Targets

Add code
Jun 01, 2026
Viaarxiv icon

Cross-Talk Speech Reduction, by Separation, for Separation

Add code
May 19, 2026
Viaarxiv icon

Ring Mixing with Auxiliary Signal-to-Consistency-Error Ratio Loss for Unsupervised Denoising in Speech Separation

Add code
Apr 09, 2026
Viaarxiv icon

Who Spoke What When? Evaluating Spoken Language Models for Conversational ASR with Semantic and Overlap-Aware Metrics

Add code
Mar 24, 2026
Viaarxiv icon

Modeling Overlapped Speech with Shuffles

Add code
Mar 18, 2026
Viaarxiv icon

SE-DiCoW: Self-Enrolled Diarization-Conditioned Whisper

Add code
Jan 27, 2026
Viaarxiv icon

The CMU-AIST submission for the ICME 2025 Audio Encoder Challenge

Add code
Jan 22, 2026
Viaarxiv icon