Picture for Chengyou Wang

Chengyou Wang

On-Policy Self-Distillation for Multi-Dialect ASR: Mastering Dialects, Retaining Mandarin

Add code
Aug 12, 2026
Viaarxiv icon

SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation

Add code
Aug 07, 2026
Viaarxiv icon

MSU-Bench: Towards Speaker-Centric Understanding in Conversational Multi-Speaker Scenarios

Add code
Jun 22, 2026
Viaarxiv icon

Full-Duplex Interaction in Spoken Dialogue Systems: A Comprehensive Study from the ICASSP 2026 HumDial Challenge

Add code
Apr 23, 2026
Viaarxiv icon

HumDial-EIBench: A Human-Recorded Multi-Turn Emotional Intelligence Benchmark for Audio Language Models

Add code
Apr 13, 2026
Viaarxiv icon

FastTurn: Unifying Acoustic and Streaming Semantic Cues for Low-Latency and Robust Turn Detection

Add code
Apr 07, 2026
Viaarxiv icon

OmniCodec: Low Frame Rate Universal Audio Codec with Semantic-Acoustic Disentanglement

Add code
Mar 21, 2026
Viaarxiv icon

WenetSpeech-Wu: Datasets, Benchmarks, and Models for a Unified Chinese Wu Dialect Speech Processing Ecosystem

Add code
Jan 16, 2026
Viaarxiv icon

VoiceSculptor: Your Voice, Designed By You

Add code
Jan 15, 2026
Viaarxiv icon

MSU-Bench: Towards Understanding the Conversational Multi-talker Scenarios

Add code
Aug 11, 2025
Viaarxiv icon