Picture for Daisuke Saito

Daisuke Saito

Self-supervised Speech Comparison for L2 Phone, Rhythm, and Intonation Scoring

Add code
Jul 15, 2026
Viaarxiv icon

Phone Segmentation and Recognition through Phonological Activation Mapping

Add code
Jul 10, 2026
Viaarxiv icon

Speech Playground: An Interactive Tool for Speech Analysis and Comparison

Add code
Jul 01, 2026
Viaarxiv icon

SSL-GMMVC: Interpretable Voice Conversion via Locally Linear GMM Transforms in Self-Supervised Representation Space

Add code
Jun 09, 2026
Viaarxiv icon

Leveraging Soft Distributions of SSL-Derived Discrete Speech Tokens for Downstream Inference

Add code
Jun 05, 2026
Viaarxiv icon

Prosodic ABX: A Language-Agnostic Method for Measuring Prosodic Contrast in Speech Representations

Add code
Apr 02, 2026
Viaarxiv icon

Kanade: A Simple Disentangled Tokenizer for Spoken Language Modeling

Add code
Jan 31, 2026
Viaarxiv icon

A Perception-Based L2 Speech Intelligibility Indicator: Leveraging a Rater's Shadowing and Sequence-to-sequence Voice Conversion

Add code
May 30, 2025
Figure 1 for A Perception-Based L2 Speech Intelligibility Indicator: Leveraging a Rater's Shadowing and Sequence-to-sequence Voice Conversion
Figure 2 for A Perception-Based L2 Speech Intelligibility Indicator: Leveraging a Rater's Shadowing and Sequence-to-sequence Voice Conversion
Figure 3 for A Perception-Based L2 Speech Intelligibility Indicator: Leveraging a Rater's Shadowing and Sequence-to-sequence Voice Conversion
Figure 4 for A Perception-Based L2 Speech Intelligibility Indicator: Leveraging a Rater's Shadowing and Sequence-to-sequence Voice Conversion
Viaarxiv icon

Prosodically Enhanced Foreign Accent Simulation by Discrete Token-based Resynthesis Only with Native Speech Corpora

Add code
May 22, 2025
Viaarxiv icon

Discrete Tokens Exhibit Interlanguage Speech Intelligibility Benefit: an Analytical Study Towards Accent-robust ASR Only with Native Speech Data

Add code
May 22, 2025
Figure 1 for Discrete Tokens Exhibit Interlanguage Speech Intelligibility Benefit: an Analytical Study Towards Accent-robust ASR Only with Native Speech Data
Figure 2 for Discrete Tokens Exhibit Interlanguage Speech Intelligibility Benefit: an Analytical Study Towards Accent-robust ASR Only with Native Speech Data
Figure 3 for Discrete Tokens Exhibit Interlanguage Speech Intelligibility Benefit: an Analytical Study Towards Accent-robust ASR Only with Native Speech Data
Figure 4 for Discrete Tokens Exhibit Interlanguage Speech Intelligibility Benefit: an Analytical Study Towards Accent-robust ASR Only with Native Speech Data
Viaarxiv icon