Picture for Lvmin Zhang

Lvmin Zhang

FlexComposer: Unified Video Compositing from Images to Dynamic Footage with Flexible Trajectory Control

Add code
Jul 31, 2026
Viaarxiv icon

Masked Visual Actions for Unified World Modeling

Add code
Jul 21, 2026
Viaarxiv icon

FourTune: Towards Fully 4-Bit Efficient Post-Training for Diffusion Models

Add code
Jul 07, 2026
Viaarxiv icon

EvalVerse: Pipeline-Aware and Expert-Calibrated Benchmarking for Professional Cinematic Video Generation

Add code
May 22, 2026
Viaarxiv icon

View-oriented Conversation Compiler for Agent Trace Analysis

Add code
Apr 01, 2026
Viaarxiv icon

Mode Seeking meets Mean Seeking for Fast Long Video Generation

Add code
Feb 27, 2026
Viaarxiv icon

Pretraining Frame Preservation in Autoregressive Video Memory Compression

Add code
Dec 29, 2025
Viaarxiv icon

StreamDiffusionV2: A Streaming System for Dynamic and Interactive Video Generation

Add code
Nov 10, 2025
Figure 1 for StreamDiffusionV2: A Streaming System for Dynamic and Interactive Video Generation
Figure 2 for StreamDiffusionV2: A Streaming System for Dynamic and Interactive Video Generation
Figure 3 for StreamDiffusionV2: A Streaming System for Dynamic and Interactive Video Generation
Figure 4 for StreamDiffusionV2: A Streaming System for Dynamic and Interactive Video Generation
Viaarxiv icon

Taming Flow-based I2V Models for Creative Video Editing

Add code
Sep 26, 2025
Viaarxiv icon

Mixture of Contexts for Long Video Generation

Add code
Aug 28, 2025
Viaarxiv icon