Picture for Enze Xie

Enze Xie

Sol-Attn: Accelerating Video Generation Inference via On-the-Fly Attention Sparsification

Add code
Jul 27, 2026
Viaarxiv icon

SANA-Video 2.0: Hybrid Linear Attention with Attention Residuals for Efficient Video Generation

Add code
Jul 23, 2026
Viaarxiv icon

Nemotron-Labs-Diffusion: A Tri-Mode Language Model Unifying Autoregressive, Diffusion, and Self-Speculation Decoding

Add code
Jul 07, 2026
Viaarxiv icon

RoboDojo: A Unified Sim-and-Real Benchmark for Comprehensive Evaluation of Generalist Robot Manipulation Policies

Add code
Jul 05, 2026
Viaarxiv icon

PhysisForcing: Physics Reinforced World Simulator for Robotic Manipulation

Add code
Jun 26, 2026
Viaarxiv icon

Sol Video Inference Engine: Agent-Native Full-Stack Acceleration Framework for Efficient Video Generation

Add code
Jun 24, 2026
Viaarxiv icon

HumanScale: Egocentric Human Video Can Outperform Real-Robot Data for Embodied Pretraining

Add code
Jun 18, 2026
Viaarxiv icon

Light Interaction: Training-Free Inference Acceleration for Interactive Video World Models

Add code
May 29, 2026
Viaarxiv icon

SANA-Streaming: Real-time Streaming Video Editing with Hybrid Diffusion Transformer

Add code
May 28, 2026
Viaarxiv icon

Fast-dDrive: Efficient Block-Diffusion VLM for Autonomous Driving

Add code
May 25, 2026
Viaarxiv icon