Picture for Duomin Wang

Duomin Wang

Sol-Attn: Accelerating Video Generation Inference via On-the-Fly Attention Sparsification

Add code
Jul 27, 2026
Viaarxiv icon

Motion4Motion: Motion Transfer Across Subjects at Inference

Add code
Jul 13, 2026
Viaarxiv icon

PhysisForcing: Physics Reinforced World Simulator for Robotic Manipulation

Add code
Jun 26, 2026
Viaarxiv icon

HumanScale: Egocentric Human Video Can Outperform Real-Robot Data for Embodied Pretraining

Add code
Jun 18, 2026
Viaarxiv icon

PuYun-LDM: A Latent Diffusion Model for High-Resolution Ensemble Weather Forecasts

Add code
Feb 13, 2026
Viaarxiv icon

Training-Free Text-Guided Color Editing with Multi-Modal Diffusion Transformer

Add code
Aug 12, 2025
Figure 1 for Training-Free Text-Guided Color Editing with Multi-Modal Diffusion Transformer
Figure 2 for Training-Free Text-Guided Color Editing with Multi-Modal Diffusion Transformer
Figure 3 for Training-Free Text-Guided Color Editing with Multi-Modal Diffusion Transformer
Figure 4 for Training-Free Text-Guided Color Editing with Multi-Modal Diffusion Transformer
Viaarxiv icon

Taming Teacher Forcing for Masked Autoregressive Video Generation

Add code
Jan 21, 2025
Figure 1 for Taming Teacher Forcing for Masked Autoregressive Video Generation
Figure 2 for Taming Teacher Forcing for Masked Autoregressive Video Generation
Figure 3 for Taming Teacher Forcing for Masked Autoregressive Video Generation
Figure 4 for Taming Teacher Forcing for Masked Autoregressive Video Generation
Viaarxiv icon

Portrait4D-v2: Pseudo Multi-View Data Creates Better 4D Head Synthesizer

Add code
Mar 20, 2024
Figure 1 for Portrait4D-v2: Pseudo Multi-View Data Creates Better 4D Head Synthesizer
Figure 2 for Portrait4D-v2: Pseudo Multi-View Data Creates Better 4D Head Synthesizer
Figure 3 for Portrait4D-v2: Pseudo Multi-View Data Creates Better 4D Head Synthesizer
Figure 4 for Portrait4D-v2: Pseudo Multi-View Data Creates Better 4D Head Synthesizer
Viaarxiv icon

PICTURE: PhotorealistIC virtual Try-on from UnconstRained dEsigns

Add code
Dec 07, 2023
Figure 1 for PICTURE: PhotorealistIC virtual Try-on from UnconstRained dEsigns
Figure 2 for PICTURE: PhotorealistIC virtual Try-on from UnconstRained dEsigns
Figure 3 for PICTURE: PhotorealistIC virtual Try-on from UnconstRained dEsigns
Figure 4 for PICTURE: PhotorealistIC virtual Try-on from UnconstRained dEsigns
Viaarxiv icon

AgentAvatar: Disentangling Planning, Driving and Rendering for Photorealistic Avatar Agents

Add code
Dec 04, 2023
Figure 1 for AgentAvatar: Disentangling Planning, Driving and Rendering for Photorealistic Avatar Agents
Figure 2 for AgentAvatar: Disentangling Planning, Driving and Rendering for Photorealistic Avatar Agents
Figure 3 for AgentAvatar: Disentangling Planning, Driving and Rendering for Photorealistic Avatar Agents
Figure 4 for AgentAvatar: Disentangling Planning, Driving and Rendering for Photorealistic Avatar Agents
Viaarxiv icon