Picture for Yuepeng Jiang

Yuepeng Jiang

MiDashengLM-Gen: Unified Audio Scene Generation via LLM-Driven Autoregressive Flow Matching

Add code
Aug 12, 2026
Viaarxiv icon

SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation

Add code
Aug 07, 2026
Viaarxiv icon

MeanVC 2: Robust Low-Latency Streaming Zero-Shot Voice Conversion

Add code
Jun 08, 2026
Viaarxiv icon

MINT-Bench: A Comprehensive Multilingual Benchmark for Instruction-Following Text-to-Speech

Add code
Apr 20, 2026
Viaarxiv icon

YingMusic-Singer: Controllable Singing Voice Synthesis with Flexible Lyric Manipulation and Annotation-free Melody Guidance

Add code
Mar 25, 2026
Viaarxiv icon

DiffRhythm 2: Efficient and High Fidelity Song Generation via Block Flow Matching

Add code
Oct 27, 2025
Viaarxiv icon

REF-VC: Robust, Expressive and Fast Zero-Shot Voice Conversion with Diffusion Transformers

Add code
Aug 07, 2025
Viaarxiv icon

SongEval: A Benchmark Dataset for Song Aesthetics Evaluation

Add code
May 16, 2025
Viaarxiv icon

DiffRhythm: Blazingly Fast and Embarrassingly Simple End-to-End Full-Length Song Generation with Latent Diffusion

Add code
Mar 03, 2025
Viaarxiv icon

Drop the beat! Freestyler for Accompaniment Conditioned Rapping Voice Generation

Add code
Aug 28, 2024
Figure 1 for Drop the beat! Freestyler for Accompaniment Conditioned Rapping Voice Generation
Figure 2 for Drop the beat! Freestyler for Accompaniment Conditioned Rapping Voice Generation
Figure 3 for Drop the beat! Freestyler for Accompaniment Conditioned Rapping Voice Generation
Figure 4 for Drop the beat! Freestyler for Accompaniment Conditioned Rapping Voice Generation
Viaarxiv icon