Picture for Hanxin Zhu

Hanxin Zhu

EmbodiedVAE: Disentangled Video VAE for Efficient and Controllable Embodied Manipulation

Add code
Aug 04, 2026
Viaarxiv icon

DeformGen: Dynamics-Based Topology Augmentation for Deformable Manipulation Policy Learning

Add code
Jun 24, 2026
Viaarxiv icon

CP4D: Compositional Physics-aware 4D Scene Generation

Add code
Jun 08, 2026
Viaarxiv icon

Physics-Informed Video Generation via Mixture-of-Experts Latent Alignment

Add code
Jun 03, 2026
Viaarxiv icon

Future Forcing: Future-aware Training-free KV Cache Policy for Autoregressive Video Generation

Add code
May 28, 2026
Viaarxiv icon

GTA: Advancing Image-to-3D World Generation via Geometry Then Appearance Video Diffusion

Add code
May 13, 2026
Viaarxiv icon

Embody4D: A Generalist 4D World Model for Embodied AI

Add code
May 03, 2026
Viaarxiv icon

Training-Free Sparse Attention for Fast Video Generation via Offline Layer-Wise Sparsity Profiling and Online Bidirectional Co-Clustering

Add code
Mar 19, 2026
Viaarxiv icon

PhysVideo: Physically Plausible Video Generation with Cross-View Geometry Guidance

Add code
Mar 19, 2026
Viaarxiv icon

VLA-JEPA: Enhancing Vision-Language-Action Model with Latent World Model

Add code
Feb 14, 2026
Viaarxiv icon