Picture for William Chen

William Chen

Why Does Action Chunking Improve Behavioral Cloning Performance in Robotic Control?

Add code
Aug 03, 2026
Viaarxiv icon

Dissecting Sensitivity to Training Language in Self-Supervised Speech Learning Using Neural Audio Codec Tokens

Add code
Jul 28, 2026
Viaarxiv icon

MulTTiPop: A Multitrack Transcription Dataset for Pop Music

Add code
Jul 09, 2026
Viaarxiv icon

Adapting Generalist Robot Policies with Semantic Reinforcement Learning

Add code
Jun 30, 2026
Viaarxiv icon

ESPnet3: Infrastructure for Scalable Speech and Audio Research in the Foundation Model Era

Add code
Jun 20, 2026
Viaarxiv icon

Evaluating Large Language Models Abilities for Addressee, Turn-change, and Next Speaker Prediction in Meetings

Add code
Jun 16, 2026
Viaarxiv icon

Improving Robotic Generalist Policies via Flow Reversal Steering

Add code
Jun 11, 2026
Viaarxiv icon

An Empirical Recipe for Universal Phone Recognition

Add code
Mar 30, 2026
Viaarxiv icon

Steerable Vision-Language-Action Policies for Embodied Reasoning and Hierarchical Control

Add code
Feb 13, 2026
Viaarxiv icon

Bagpiper: Solving Open-Ended Audio Tasks via Rich Captions

Add code
Feb 05, 2026
Viaarxiv icon