Picture for Zhenkai Zhang

Zhenkai Zhang

Population-Scalable Multi-Agent World Modeling

Add code
Aug 09, 2026
Viaarxiv icon

TCAM-Diff: Triplane-Aware Cross-Attention Medical Diffusion Model

Add code
Jul 15, 2026
Viaarxiv icon

HAT-4D: Lifting Monocular Video for 4D Multi-Object Interactions via Human-Agent Collaboration

Add code
Jun 26, 2026
Viaarxiv icon

From Sparse X-rays to 3D CT: Training-Free Reconstruction with Diffusion Priors

Add code
Jun 18, 2026
Viaarxiv icon

Pixel-Level Residual Diffusion Transformer: Scalable 3D CT Volume Generation

Add code
Jun 18, 2026
Viaarxiv icon

GPU-Fuzz: Finding Memory Errors in Deep Learning Frameworks

Add code
Feb 13, 2026
Viaarxiv icon

Improving Denoising Diffusion Models via Simultaneous Estimation of Image and Noise

Add code
Oct 26, 2023
Figure 1 for Improving Denoising Diffusion Models via Simultaneous Estimation of Image and Noise
Figure 2 for Improving Denoising Diffusion Models via Simultaneous Estimation of Image and Noise
Figure 3 for Improving Denoising Diffusion Models via Simultaneous Estimation of Image and Noise
Figure 4 for Improving Denoising Diffusion Models via Simultaneous Estimation of Image and Noise
Viaarxiv icon

Multiscale Representation for Real-Time Anti-Aliasing Neural Rendering

Add code
Apr 20, 2023
Figure 1 for Multiscale Representation for Real-Time Anti-Aliasing Neural Rendering
Figure 2 for Multiscale Representation for Real-Time Anti-Aliasing Neural Rendering
Figure 3 for Multiscale Representation for Real-Time Anti-Aliasing Neural Rendering
Figure 4 for Multiscale Representation for Real-Time Anti-Aliasing Neural Rendering
Viaarxiv icon

Open Set Recognition using Vision Transformer with an Additional Detection Head

Add code
Mar 16, 2022
Figure 1 for Open Set Recognition using Vision Transformer with an Additional Detection Head
Figure 2 for Open Set Recognition using Vision Transformer with an Additional Detection Head
Figure 3 for Open Set Recognition using Vision Transformer with an Additional Detection Head
Figure 4 for Open Set Recognition using Vision Transformer with an Additional Detection Head
Viaarxiv icon