Picture for Ashishkumar P. Gudmalwar

Ashishkumar P. Gudmalwar

Adaptive Oscillatory Inductive Bias for Modeling Sharp Prosodic Dynamics in Diffusion-Based TTS

Add code
Jun 24, 2026
Viaarxiv icon

CrossAccent-TTS: Cross-Lingual Accent-Intensity Controllable Text-to-Speech via Disentangled Speaker and Accent Representations

Add code
Jun 24, 2026
Viaarxiv icon

Gesture2Speech: How Far Can Hand Movements Shape Expressive Speech?

Add code
Mar 20, 2026
Viaarxiv icon

REWIND: Speech Time Reversal for Enhancing Speaker Representations in Diffusion-based Voice Conversion

Add code
May 27, 2025
Viaarxiv icon

Isometric Neural Machine Translation using Phoneme Count Ratio Reward-based Reinforcement Learning

Add code
Mar 20, 2024
Figure 1 for Isometric Neural Machine Translation using Phoneme Count Ratio Reward-based Reinforcement Learning
Figure 2 for Isometric Neural Machine Translation using Phoneme Count Ratio Reward-based Reinforcement Learning
Figure 3 for Isometric Neural Machine Translation using Phoneme Count Ratio Reward-based Reinforcement Learning
Figure 4 for Isometric Neural Machine Translation using Phoneme Count Ratio Reward-based Reinforcement Learning
Viaarxiv icon