Picture for Zhenzhong Chen

Zhenzhong Chen

DiffCVE: Diffusion-based Compressed Video Enhancement

Add code
Jul 08, 2026
Viaarxiv icon

ETC: Extreme Token Compression via Task-aware Visual Information Distillation in VLMs

Add code
May 30, 2026
Viaarxiv icon

Robotic Scene Cloning:Advancing Zero-Shot Robotic Scene Adaptation in Manipulation via Visual Prompt Editing

Add code
Mar 10, 2026
Viaarxiv icon

DiffVC-RT: Towards Practical Real-Time Diffusion-based Perceptual Neural Video Compression

Add code
Jan 28, 2026
Viaarxiv icon

DiffVC-OSD: One-Step Diffusion-based Perceptual Neural Video Compression Framework

Add code
Aug 11, 2025
Viaarxiv icon

LOP: Learning Optimal Pruning for Efficient On-Demand MLLMs Scaling

Add code
Jun 15, 2025
Viaarxiv icon

RSFAKE-1M: A Large-Scale Dataset for Detecting Diffusion-Generated Remote Sensing Forgeries

Add code
May 29, 2025
Figure 1 for RSFAKE-1M: A Large-Scale Dataset for Detecting Diffusion-Generated Remote Sensing Forgeries
Figure 2 for RSFAKE-1M: A Large-Scale Dataset for Detecting Diffusion-Generated Remote Sensing Forgeries
Figure 3 for RSFAKE-1M: A Large-Scale Dataset for Detecting Diffusion-Generated Remote Sensing Forgeries
Figure 4 for RSFAKE-1M: A Large-Scale Dataset for Detecting Diffusion-Generated Remote Sensing Forgeries
Viaarxiv icon

Training-Free Reasoning and Reflection in MLLMs

Add code
May 22, 2025
Viaarxiv icon

Frequency Enhancement for Image Demosaicking

Add code
Mar 20, 2025
Viaarxiv icon

LongCaptioning: Unlocking the Power of Long Caption Generation in Large Multimodal Models

Add code
Feb 21, 2025
Viaarxiv icon