Picture for Junwon Moon

Junwon Moon

DELTA-TTS: Adapting Autoregressive Model into Diffusion Language Model for Text-to-Speech

Add code
Jul 05, 2026
Viaarxiv icon

TLDR: Compressing Audio Tokens for Efficient Autoregressive Text-to-Speech

Add code
Jun 08, 2026
Viaarxiv icon

Mask2Flow-TSE: Two-Stage Target Speaker Extraction with Masking and Flow Matching

Add code
Mar 13, 2026
Viaarxiv icon