Picture for Minsu Kang

Minsu Kang

Designed Vocalizations Dataset: Sound-Designed Human and Animal Voices for Non-human Voice Conversion

Add code
Jul 23, 2026
Viaarxiv icon

When Humans Growl and Birds Speak: High-Fidelity Voice Conversion from Human to Animal and Designed Sounds

Add code
May 30, 2025
Viaarxiv icon

UniTTS: Residual Learning of Unified Embedding Space for Speech Style Control

Add code
Jun 21, 2021
Figure 1 for UniTTS: Residual Learning of Unified Embedding Space for Speech Style Control
Figure 2 for UniTTS: Residual Learning of Unified Embedding Space for Speech Style Control
Figure 3 for UniTTS: Residual Learning of Unified Embedding Space for Speech Style Control
Figure 4 for UniTTS: Residual Learning of Unified Embedding Space for Speech Style Control
Viaarxiv icon

Fast DCTTS: Efficient Deep Convolutional Text-to-Speech

Add code
Apr 01, 2021
Figure 1 for Fast DCTTS: Efficient Deep Convolutional Text-to-Speech
Figure 2 for Fast DCTTS: Efficient Deep Convolutional Text-to-Speech
Figure 3 for Fast DCTTS: Efficient Deep Convolutional Text-to-Speech
Figure 4 for Fast DCTTS: Efficient Deep Convolutional Text-to-Speech
Viaarxiv icon