Picture for Zongyu Guo

Zongyu Guo

Mage-VL: An Efficient Codec-Native Streaming Multimodal Foundation Model

Add code
Jul 27, 2026
Viaarxiv icon

Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing

Add code
Jul 21, 2026
Viaarxiv icon

From Content to Knowledge: Lightning Fast Long-Video Understanding with Neural Knowledge Representations

Add code
Jun 10, 2026
Viaarxiv icon

Ultra-Fast Neural Video Compression

Add code
Jun 03, 2026
Viaarxiv icon

CoD-Lite: Real-Time Diffusion-Based Generative Image Compression

Add code
Apr 14, 2026
Viaarxiv icon

Generative Video Compression with One-Dimensional Latent Representation

Add code
Mar 16, 2026
Viaarxiv icon

Compression as Adaptation: Implicit Visual Representation with Diffusion Foundation Models

Add code
Mar 08, 2026
Viaarxiv icon

InfiniteWeb: Scalable Web Environment Synthesis for GUI Agent Training

Add code
Jan 08, 2026
Viaarxiv icon

Deep Video Discovery: Agentic Search with Tool Use for Long-form Video Understanding

Add code
May 23, 2025
Viaarxiv icon

UniMIC: Towards Universal Multi-modality Perceptual Image Compression

Add code
Dec 09, 2024
Figure 1 for UniMIC: Towards Universal Multi-modality Perceptual Image Compression
Figure 2 for UniMIC: Towards Universal Multi-modality Perceptual Image Compression
Figure 3 for UniMIC: Towards Universal Multi-modality Perceptual Image Compression
Figure 4 for UniMIC: Towards Universal Multi-modality Perceptual Image Compression
Viaarxiv icon