Picture for Jing Peng

Jing Peng

dots.tts.edit: Precisely Controlled Speech Editing with a Continuous Autoregressive Model

Add code
Aug 11, 2026
Viaarxiv icon

Externalizing Research Synthesis and Validation in AI Scientists through a Research Harness

Add code
Jun 17, 2026
Viaarxiv icon

XFlow: An Executable Protocol Programming System for Reliable Multi-Agent Workflows

Add code
Jun 11, 2026
Viaarxiv icon

VISA: A Visual Information Strengthened Audio-Reasoning System for the Interspeech 2026 ARC Agent Track

Add code
Jun 05, 2026
Viaarxiv icon

A Unified and Reproducible Experimentation Framework for Speech Understanding

Add code
May 29, 2026
Viaarxiv icon

Audio-Mind: An Auditable Agentic Framework for Audio Understanding

Add code
May 27, 2026
Viaarxiv icon

LoSATok: Low-dimensional Semantic-Acoustic Tokenizer for Cross-Domain Audio Understanding and Generation

Add code
May 27, 2026
Viaarxiv icon

RAS: a Reliability Oriented Metric for Automatic Speech Recognition

Add code
Apr 28, 2026
Viaarxiv icon

TASU2: Controllable CTC Simulation for Alignment and Low-Resource Adaptation of Speech LLMs

Add code
Apr 09, 2026
Viaarxiv icon

Beyond Descriptions: A Generative Scene2Audio Framework for Blind and Low-Vision Users to Experience Vista Landscapes

Add code
Mar 28, 2026
Viaarxiv icon