Picture for Jiepeng Wang

Jiepeng Wang

MMOE: Modernizing Diffusion Transformers with Efficient Expert Design

Add code
Jul 27, 2026
Viaarxiv icon

ShotPlan: Cinematic Video Generation with Learnable Planning Token

Add code
Jul 20, 2026
Viaarxiv icon

SIFT: Self-Imagination Fine-Tuning for Physically Plausible Motion in Video Diffusion Models

Add code
Jun 26, 2026
Viaarxiv icon

TeleWorld: Towards Dynamic Multimodal Synthesis with a 4D World Model

Add code
Dec 31, 2025
Viaarxiv icon

Uni-Inter: Unifying 3D Human Motion Synthesis Across Diverse Interaction Contexts

Add code
Nov 17, 2025
Viaarxiv icon

Towards a Generalizable Bimanual Foundation Policy via Flow-based Video Prediction

Add code
May 30, 2025
Viaarxiv icon

Metric-Solver: Sliding Anchored Metric Depth Estimation from a Single Image

Add code
Apr 16, 2025
Viaarxiv icon

OmniVDiff: Omni Controllable Video Diffusion for Generation and Understanding

Add code
Apr 15, 2025
Figure 1 for OmniVDiff: Omni Controllable Video Diffusion for Generation and Understanding
Figure 2 for OmniVDiff: Omni Controllable Video Diffusion for Generation and Understanding
Figure 3 for OmniVDiff: Omni Controllable Video Diffusion for Generation and Understanding
Figure 4 for OmniVDiff: Omni Controllable Video Diffusion for Generation and Understanding
Viaarxiv icon

MMGen: Unified Multi-modal Image Generation and Understanding in One Go

Add code
Mar 26, 2025
Viaarxiv icon

MVTokenFlow: High-quality 4D Content Generation using Multiview Token Flow

Add code
Feb 17, 2025
Viaarxiv icon