Picture for Ziang Cao

Ziang Cao

Data Pyramid for Embodied Manipulation

Add code
Jul 27, 2026
Viaarxiv icon

Apple-$π$: Benchmarking Thinking with Video Towards Law-Grounded Physical Intelligence

Add code
Jul 17, 2026
Viaarxiv icon

PhysX-Omni: Unified Simulation-Ready Physical 3D Generation for Rigid, Deformable, and Articulated Objects

Add code
May 20, 2026
Viaarxiv icon

PhysX-Anything: Simulation-Ready Physical 3D Assets from Single Image

Add code
Nov 17, 2025
Viaarxiv icon

Collaborative Multi-Modal Coding for High-Quality 3D Generation

Add code
Aug 21, 2025
Viaarxiv icon

PhysX: Physical-Grounded 3D Asset Generation

Add code
Jul 16, 2025
Figure 1 for PhysX: Physical-Grounded 3D Asset Generation
Figure 2 for PhysX: Physical-Grounded 3D Asset Generation
Figure 3 for PhysX: Physical-Grounded 3D Asset Generation
Figure 4 for PhysX: Physical-Grounded 3D Asset Generation
Viaarxiv icon

DiffTF++: 3D-aware Diffusion Transformer for Large-Vocabulary 3D Generation

Add code
May 13, 2024
Figure 1 for DiffTF++: 3D-aware Diffusion Transformer for Large-Vocabulary 3D Generation
Figure 2 for DiffTF++: 3D-aware Diffusion Transformer for Large-Vocabulary 3D Generation
Figure 3 for DiffTF++: 3D-aware Diffusion Transformer for Large-Vocabulary 3D Generation
Figure 4 for DiffTF++: 3D-aware Diffusion Transformer for Large-Vocabulary 3D Generation
Viaarxiv icon

3DTopia: Large Text-to-3D Generation Model with Hybrid Diffusion Priors

Add code
Mar 04, 2024
Figure 1 for 3DTopia: Large Text-to-3D Generation Model with Hybrid Diffusion Priors
Figure 2 for 3DTopia: Large Text-to-3D Generation Model with Hybrid Diffusion Priors
Figure 3 for 3DTopia: Large Text-to-3D Generation Model with Hybrid Diffusion Priors
Figure 4 for 3DTopia: Large Text-to-3D Generation Model with Hybrid Diffusion Priors
Viaarxiv icon

Large-Vocabulary 3D Diffusion Model with Transformer

Add code
Sep 15, 2023
Figure 1 for Large-Vocabulary 3D Diffusion Model with Transformer
Figure 2 for Large-Vocabulary 3D Diffusion Model with Transformer
Figure 3 for Large-Vocabulary 3D Diffusion Model with Transformer
Figure 4 for Large-Vocabulary 3D Diffusion Model with Transformer
Viaarxiv icon

Towards Real-World Visual Tracking with Temporal Contexts

Add code
Aug 20, 2023
Viaarxiv icon