Picture for Haokui Zhang

Haokui Zhang

EGM-Det: Entropy-Guided Multimodal Adaptive Fusion for UAV RGB-IR Object Detection

Add code
Aug 12, 2026
Viaarxiv icon

When Vision Becomes Text: Visual Token Pruning via Cross-Modal Residual Guidance in VLMs

Add code
Aug 11, 2026
Viaarxiv icon

DVANet: Degradation-aware Visual-prior Alignment Network for Image Restoration

Add code
Jun 17, 2026
Viaarxiv icon

M$^2$: Dual-Memory Augmentation for Long-Horizon Web Agents via Trajectory Summarization and Insight Retrieval

Add code
Feb 28, 2026
Viaarxiv icon

Rethinking Practical and Efficient Quantization Calibration for Vision-Language Models

Add code
Feb 08, 2026
Viaarxiv icon

Open-Text Aerial Detection: A Unified Framework For Aerial Visual Grounding And Detection

Add code
Feb 08, 2026
Viaarxiv icon

Unlocking Prototype Potential: An Efficient Tuning Framework for Few-Shot Class-Incremental Learning

Add code
Feb 05, 2026
Viaarxiv icon

PIO-FVLM: Rethinking Training-Free Visual Token Reduction for VLM Acceleration from an Inference-Objective Perspective

Add code
Feb 05, 2026
Viaarxiv icon

SALAD-Pan: Sensor-Agnostic Latent Adaptive Diffusion for Pan-Sharpening

Add code
Feb 04, 2026
Viaarxiv icon

Teaching Prompts to Coordinate: Hierarchical Layer-Grouped Prompt Tuning for Continual Learning

Add code
Nov 15, 2025
Figure 1 for Teaching Prompts to Coordinate: Hierarchical Layer-Grouped Prompt Tuning for Continual Learning
Figure 2 for Teaching Prompts to Coordinate: Hierarchical Layer-Grouped Prompt Tuning for Continual Learning
Figure 3 for Teaching Prompts to Coordinate: Hierarchical Layer-Grouped Prompt Tuning for Continual Learning
Figure 4 for Teaching Prompts to Coordinate: Hierarchical Layer-Grouped Prompt Tuning for Continual Learning
Viaarxiv icon