Picture for Congyang Ou

Congyang Ou

When Vision Becomes Text: Visual Token Pruning via Cross-Modal Residual Guidance in VLMs

Add code
Aug 11, 2026
Viaarxiv icon

PIO-FVLM: Rethinking Training-Free Visual Token Reduction for VLM Acceleration from an Inference-Objective Perspective

Add code
Feb 05, 2026
Viaarxiv icon

SALAD-Pan: Sensor-Agnostic Latent Adaptive Diffusion for Pan-Sharpening

Add code
Feb 04, 2026
Viaarxiv icon