Picture for Zhangkai Ni

Zhangkai Ni

Vorch-Streamer: Extending Human Audio-Visual Generation to Real-Time Long-Form Streaming

Add code
Aug 07, 2026
Viaarxiv icon

LoMeVQA: A Comprehensive Benchmark for Longitudinal Medical VQA

Add code
Jul 30, 2026
Viaarxiv icon

EntropyPrune: Matrix Entropy Guided Visual Token Pruning for Multimodal Large Language Models

Add code
Feb 19, 2026
Viaarxiv icon

Wavelet-Domain Masked Image Modeling for Color-Consistent HDR Video Reconstruction

Add code
Feb 07, 2026
Viaarxiv icon

FlowBypass: Rectified Flow Trajectory Bypass for Training-Free Image Editing

Add code
Feb 02, 2026
Viaarxiv icon

All You Need Are Random Visual Tokens? Demystifying Token Pruning in VLLMs

Add code
Dec 08, 2025
Viaarxiv icon

Perceptual-GS: Scene-adaptive Perceptual Densification for Gaussian Splatting

Add code
Jun 14, 2025
Viaarxiv icon

Structural Similarity-Inspired Unfolding for Lightweight Image Super-Resolution

Add code
Jun 13, 2025
Viaarxiv icon

Unrolled Decomposed Unpaired Learning for Controllable Low-Light Video Enhancement

Add code
Aug 22, 2024
Figure 1 for Unrolled Decomposed Unpaired Learning for Controllable Low-Light Video Enhancement
Figure 2 for Unrolled Decomposed Unpaired Learning for Controllable Low-Light Video Enhancement
Figure 3 for Unrolled Decomposed Unpaired Learning for Controllable Low-Light Video Enhancement
Figure 4 for Unrolled Decomposed Unpaired Learning for Controllable Low-Light Video Enhancement
Viaarxiv icon

DDR: Exploiting Deep Degradation Response as Flexible Image Descriptor

Add code
Jun 12, 2024
Figure 1 for DDR: Exploiting Deep Degradation Response as Flexible Image Descriptor
Figure 2 for DDR: Exploiting Deep Degradation Response as Flexible Image Descriptor
Figure 3 for DDR: Exploiting Deep Degradation Response as Flexible Image Descriptor
Figure 4 for DDR: Exploiting Deep Degradation Response as Flexible Image Descriptor
Viaarxiv icon