Picture for Zifan Shi

Zifan Shi

Native Video-Action Pretraining for Generalizable Robot Control

Add code
Jul 09, 2026
Viaarxiv icon

Scaling Mixture-of-Experts Video Pretraining for Embodied Intelligence

Add code
Jul 08, 2026
Viaarxiv icon

OmniRoam: World Wandering via Long-Horizon Panoramic Video Generation

Add code
Mar 31, 2026
Viaarxiv icon

LoST: Level of Semantics Tokenization for 3D Shapes

Add code
Mar 18, 2026
Viaarxiv icon

RigAnything: Template-Free Autoregressive Rigging for Diverse 3D Assets

Add code
Feb 13, 2025
Figure 1 for RigAnything: Template-Free Autoregressive Rigging for Diverse 3D Assets
Figure 2 for RigAnything: Template-Free Autoregressive Rigging for Diverse 3D Assets
Figure 3 for RigAnything: Template-Free Autoregressive Rigging for Diverse 3D Assets
Figure 4 for RigAnything: Template-Free Autoregressive Rigging for Diverse 3D Assets
Viaarxiv icon

GRM: Large Gaussian Reconstruction Model for Efficient 3D Reconstruction and Generation

Add code
Mar 21, 2024
Figure 1 for GRM: Large Gaussian Reconstruction Model for Efficient 3D Reconstruction and Generation
Figure 2 for GRM: Large Gaussian Reconstruction Model for Efficient 3D Reconstruction and Generation
Figure 3 for GRM: Large Gaussian Reconstruction Model for Efficient 3D Reconstruction and Generation
Figure 4 for GRM: Large Gaussian Reconstruction Model for Efficient 3D Reconstruction and Generation
Viaarxiv icon

Real-time 3D-aware Portrait Editing from a Single Image

Add code
Feb 21, 2024
Figure 1 for Real-time 3D-aware Portrait Editing from a Single Image
Figure 2 for Real-time 3D-aware Portrait Editing from a Single Image
Figure 3 for Real-time 3D-aware Portrait Editing from a Single Image
Figure 4 for Real-time 3D-aware Portrait Editing from a Single Image
Viaarxiv icon

Learning Naturally Aggregated Appearance for Efficient 3D Editing

Add code
Dec 11, 2023
Figure 1 for Learning Naturally Aggregated Appearance for Efficient 3D Editing
Figure 2 for Learning Naturally Aggregated Appearance for Efficient 3D Editing
Figure 3 for Learning Naturally Aggregated Appearance for Efficient 3D Editing
Figure 4 for Learning Naturally Aggregated Appearance for Efficient 3D Editing
Viaarxiv icon

GenDeF: Learning Generative Deformation Field for Video Generation

Add code
Dec 07, 2023
Figure 1 for GenDeF: Learning Generative Deformation Field for Video Generation
Figure 2 for GenDeF: Learning Generative Deformation Field for Video Generation
Figure 3 for GenDeF: Learning Generative Deformation Field for Video Generation
Figure 4 for GenDeF: Learning Generative Deformation Field for Video Generation
Viaarxiv icon

Gaussian Shell Maps for Efficient 3D Human Generation

Add code
Nov 29, 2023
Figure 1 for Gaussian Shell Maps for Efficient 3D Human Generation
Figure 2 for Gaussian Shell Maps for Efficient 3D Human Generation
Figure 3 for Gaussian Shell Maps for Efficient 3D Human Generation
Figure 4 for Gaussian Shell Maps for Efficient 3D Human Generation
Viaarxiv icon