Picture for Dongxu Ge

Dongxu Ge

Towards Expressive and Faithful Audio-to-Image Generation: A Unified Multimodal Dataset and Synthesis Framework

Add code
Aug 10, 2026
Viaarxiv icon

UniForm: A Unified Diffusion Transformer for Audio-Video Generation

Add code
Feb 08, 2025
Figure 1 for UniForm: A Unified Diffusion Transformer for Audio-Video Generation
Figure 2 for UniForm: A Unified Diffusion Transformer for Audio-Video Generation
Figure 3 for UniForm: A Unified Diffusion Transformer for Audio-Video Generation
Figure 4 for UniForm: A Unified Diffusion Transformer for Audio-Video Generation
Viaarxiv icon