Picture for Xiao Cao

Xiao Cao

CoinVE-200K: A Large-Scale High-Quality Dataset for Compositional Instruction-Guided Video Editing

Add code
Aug 18, 2026
Viaarxiv icon

Marrying Optimal Transport and ODEs for Unified Continuous-Time 4D Reconstruction and Tracking

Add code
Aug 10, 2026
Viaarxiv icon

GlowGS: Generative Semantic Feature Learning for 3D Gaussian Splatting in Nighttime Glow Scenes

Add code
May 22, 2026
Viaarxiv icon

Smart-Insertion-V: Photorealistic Video Insertion via a Closed-Loop Feedback Dual-Stream Framework

Add code
May 22, 2026
Viaarxiv icon

GeoQuery: Geometry-Query Diffusion for Sparse-View Reconstruction

Add code
May 12, 2026
Viaarxiv icon

Let Your Image Move with Your Motion! -- Implicit Multi-Object Multi-Motion Transfer

Add code
Mar 01, 2026
Viaarxiv icon

Tele-Omni: a Unified Multimodal Framework for Video Generation and Editing

Add code
Feb 10, 2026
Viaarxiv icon

3DSwapping: Texture Swapping For 3D Object From Single Reference Image

Add code
Mar 24, 2025
Viaarxiv icon

SSNeRF: Sparse View Semi-supervised Neural Radiance Fields with Augmentation

Add code
Aug 17, 2024
Figure 1 for SSNeRF: Sparse View Semi-supervised Neural Radiance Fields with Augmentation
Figure 2 for SSNeRF: Sparse View Semi-supervised Neural Radiance Fields with Augmentation
Figure 3 for SSNeRF: Sparse View Semi-supervised Neural Radiance Fields with Augmentation
Figure 4 for SSNeRF: Sparse View Semi-supervised Neural Radiance Fields with Augmentation
Viaarxiv icon

Towards Better Text-to-Image Generation Alignment via Attention Modulation

Add code
Apr 22, 2024
Figure 1 for Towards Better Text-to-Image Generation Alignment via Attention Modulation
Figure 2 for Towards Better Text-to-Image Generation Alignment via Attention Modulation
Figure 3 for Towards Better Text-to-Image Generation Alignment via Attention Modulation
Figure 4 for Towards Better Text-to-Image Generation Alignment via Attention Modulation
Viaarxiv icon