Picture for Zhening Liu

Zhening Liu

Mage-VL: An Efficient Codec-Native Streaming Multimodal Foundation Model

Add code
Jul 27, 2026
Viaarxiv icon

Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing

Add code
Jul 21, 2026
Viaarxiv icon

Ink3D: Sculpting 3D Assets with Extremely Complex Textures via Video Generative Models

Add code
Jul 01, 2026
Viaarxiv icon

Training-Free Image Editing with Visual Context Integration and Concept Alignment

Add code
Apr 06, 2026
Viaarxiv icon

Real-Time Human Frontal View Synthesis from a Single Image

Add code
Mar 16, 2026
Viaarxiv icon

Token-level Data Selection for Safe LLM Fine-tuning

Add code
Mar 01, 2026
Viaarxiv icon

Flash-VAED: Plug-and-Play VAE Decoders for Efficient Video Generation

Add code
Feb 22, 2026
Viaarxiv icon

Mon3tr: Monocular 3D Telepresence with Pre-built Gaussian Avatars as Amortization

Add code
Jan 12, 2026
Viaarxiv icon

Spatia: Video Generation with Updatable Spatial Memory

Add code
Dec 17, 2025
Figure 1 for Spatia: Video Generation with Updatable Spatial Memory
Figure 2 for Spatia: Video Generation with Updatable Spatial Memory
Figure 3 for Spatia: Video Generation with Updatable Spatial Memory
Figure 4 for Spatia: Video Generation with Updatable Spatial Memory
Viaarxiv icon

Task-Oriented Feature Compression for Multimodal Understanding via Device-Edge Co-Inference

Add code
Mar 17, 2025
Viaarxiv icon