Picture for Zanyi Wang

Zanyi Wang

An Empirical Study of Training Pixel-Space Text-to-Image Diffusion Models

Add code
Aug 17, 2026
Viaarxiv icon

From RGB Generation to Dense Field Readout: Pixel-Space Dense Prediction with Text-to-Image Models

Add code
Jul 09, 2026
Viaarxiv icon

D-OPSD: On-Policy Self-Distillation for Continuously Tuning Step-Distilled Diffusion Models

Add code
May 06, 2026
Viaarxiv icon

Exploring Time Conditioning in Diffusion Generative Models from Disjoint Noisy Data Manifolds

Add code
Apr 28, 2026
Viaarxiv icon

Unlocking the Potential of Grounding DINO in Videos: Parameter-Efficient Adaptation for Limited-Data Spatial-Temporal Localization

Add code
Apr 14, 2026
Viaarxiv icon

Thinking in Frames: How Visual Context and Test-Time Scaling Empower Video Reasoning

Add code
Jan 28, 2026
Viaarxiv icon

Distribution Matching Distillation Meets Reinforcement Learning

Add code
Nov 19, 2025
Viaarxiv icon