Picture for Cheng Yu

Cheng Yu

Video = World + Event Stream

Add code
Jul 16, 2026
Viaarxiv icon

Wan-Streamer v0.2: Higher Resolution, Same Latency

Add code
Jul 05, 2026
Viaarxiv icon

AV-SyncBench: Decoupled Benchmarking of Temporal and Semantic Audio-Visual Synchronization

Add code
Jul 01, 2026
Viaarxiv icon

Wan-Streamer v0.1: End-to-end Real-time Interactive Foundation Models

Add code
Jun 25, 2026
Viaarxiv icon

FreeSonic: Training-Free Temporal-Aware Decoupled Attention for Precise Audio Editing

Add code
Jun 13, 2026
Viaarxiv icon

JODA: Composable Joint Dynamics for Articulated Objects

Add code
May 11, 2026
Viaarxiv icon

DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing

Add code
Apr 28, 2026
Viaarxiv icon

AdaSpark: Adaptive Sparsity for Efficient Long-Video Understanding

Add code
Apr 09, 2026
Viaarxiv icon

SpatialReward: Verifiable Spatial Reward Modeling for Fine-Grained Spatial Consistency in Text-to-Image Generation

Add code
Mar 23, 2026
Viaarxiv icon

The Flexibility Trap: Why Arbitrary Order Limits Reasoning Potential in Diffusion Language Models

Add code
Jan 21, 2026
Viaarxiv icon