Picture for Zhipeng Xu

Zhipeng Xu

Symbiosis-Inspired Knowledge Distillation for Incremental Object Detection

Add code
Jul 15, 2026
Viaarxiv icon

Enhancing Large Multimodal Models in Key Information Extraction via Scene-Aware Document Synthesis

Add code
Jul 06, 2026
Viaarxiv icon

Latent Visual Cache for Video Reasoning

Add code
Jul 01, 2026
Viaarxiv icon

Dual-Branch Cross-Projection Debiasing through Diffusion-based Disentanglement

Add code
Jun 23, 2026
Viaarxiv icon

Adversarial Domain Prompt Tuning and Generation for Single Domain Generalization

Add code
Jun 19, 2026
Viaarxiv icon

CC-OCR V2: Benchmarking Large Multimodal Models for Literacy in Real-world Document Processing

Add code
May 05, 2026
Viaarxiv icon

Transparent and Controllable Recommendation Filtering via Multimodal Multi-Agent Collaboration

Add code
Apr 19, 2026
Viaarxiv icon

ReAlign: Optimizing the Visual Document Retriever with Reasoning-Guided Fine-Grained Alignment

Add code
Apr 08, 2026
Viaarxiv icon

Reasoning-Driven Multimodal LLM for Domain Generalization

Add code
Feb 27, 2026
Viaarxiv icon

UNIKIE-BENCH: Benchmarking Large Multimodal Models for Key Information Extraction in Visual Documents

Add code
Feb 03, 2026
Viaarxiv icon