Picture for Yu Tsao

Yu Tsao

Graduate Program of Data Science, National Taiwan University and Academia Sinica, Taipei, Taiwan, Research Center for Information Technology Innovation, Academia Sinica, Taipei, Taiwan

Navigating Speech Enhancement for Real-Time MRI: A Systematic Assessment of Signal Quality, Source Preservation, and Downstream Tasks

Add code
Aug 17, 2026
Viaarxiv icon

RT-SEMamba: Real-Time Speech Enhancement Mamba via Progressive Knowledge Distillation

Add code
Aug 12, 2026
Viaarxiv icon

End-to-End Neural Decomposition with Koopman Operators for Time-Series Forecasting

Add code
Aug 09, 2026
Viaarxiv icon

Optimal Transport-based Semantic Alignment for LLM-based Audio-Visual Speech Recognition

Add code
Jul 10, 2026
Viaarxiv icon

RRP-Voice: A Longitudinal Dataset and Benchmark for Recurrent Respiratory Papillomatosis Detection

Add code
Jun 01, 2026
Viaarxiv icon

Few-Shot and Pseudo-Label Guided Speech Quality Evaluation with Large Language Models

Add code
Apr 15, 2026
Viaarxiv icon

Tracking Listener Attention: Gaze-Guided Audio-Visual Speech Enhancement Framework

Add code
Apr 09, 2026
Viaarxiv icon

SAVe: Self-Supervised Audio-visual Deepfake Detection Exploiting Visual Artifacts and Audio-visual Misalignment

Add code
Mar 26, 2026
Viaarxiv icon

TaigiSpeech: A Low-Resource Real-World Speech Intent Dataset and Preliminary Results with Scalable Data Mining In-the-Wild

Add code
Mar 23, 2026
Viaarxiv icon

How Auditory Knowledge in LLM Backbones Shapes Audio Language Models: A Holistic Evaluation

Add code
Mar 19, 2026
Viaarxiv icon