Picture for Yuhta Takida

Yuhta Takida

Spectral Prior for Reducing Exposure Bias in Diffusion Models

Add code
Jul 24, 2026
Viaarxiv icon

TILDE: TILt-based Distributional Erasure for Concept Unlearning

Add code
Jul 07, 2026
Viaarxiv icon

Spatio-Temporal Audio Language Modeling for Dynamic Sound Sources

Add code
Jun 12, 2026
Viaarxiv icon

Efficient Reinforcement for Visual-Textual Thinking with Discrete Diffusion Model

Add code
Jun 11, 2026
Viaarxiv icon

Understanding and Accelerating the Training of Masked Diffusion Language Models

Add code
May 13, 2026
Viaarxiv icon

GUDA: Counterfactual Group-wise Training Data Attribution for Diffusion Models via Unlearning

Add code
Jan 30, 2026
Viaarxiv icon

Improved Object-Centric Diffusion Learning with Registers and Contrastive Alignment

Add code
Jan 03, 2026
Viaarxiv icon

PAVAS: Physics-Aware Video-to-Audio Synthesis

Add code
Dec 09, 2025
Figure 1 for PAVAS: Physics-Aware Video-to-Audio Synthesis
Figure 2 for PAVAS: Physics-Aware Video-to-Audio Synthesis
Figure 3 for PAVAS: Physics-Aware Video-to-Audio Synthesis
Figure 4 for PAVAS: Physics-Aware Video-to-Audio Synthesis
Viaarxiv icon

Demystifying MaskGIT Sampler and Beyond: Adaptive Order Selection in Masked Diffusion

Add code
Oct 06, 2025
Viaarxiv icon

SONA: Learning Conditional, Unconditional, and Mismatching-Aware Discriminator

Add code
Oct 06, 2025
Viaarxiv icon