Picture for Zhendong Mao

Zhendong Mao

SemComp-Bench: Benchmarking Semantic Task Completion in Video Generation

Add code
Aug 18, 2026
Viaarxiv icon

Keep It InMind: Benchmarking the Implicit-Association Blind Spot in Agent Memory

Add code
Jul 27, 2026
Viaarxiv icon

HTT-Net: Hierarchical Text-guided Transition Modeling for Surgical Video Phase Recognition

Add code
Jul 18, 2026
Viaarxiv icon

Groc-PO: Grounded Context Preference Optimization for Truthful Multimodal LLMs

Add code
Jul 15, 2026
Viaarxiv icon

Geometry-aware Gaussian Prior and Axial Attention for Cervical Cytology Image Classification

Add code
Jul 11, 2026
Viaarxiv icon

EmoStyle: Affective Conditioning of Style-Specialist Experts for Emotional Image Generation

Add code
Jul 11, 2026
Viaarxiv icon

Learning to Compose: Revisiting Proxy Task Design for Zero-Shot Composed Image Retrieval

Add code
Jul 01, 2026
Viaarxiv icon

ADAPT: Attention Dynamics Alignment with Preference Tuning for Faithful MLLMs

Add code
Jun 30, 2026
Viaarxiv icon

DailyReport: An Open-ended Benchmark for Evaluating Search Agents on Daily Search Tasks

Add code
Jun 11, 2026
Viaarxiv icon

Audio-Visual Exchange-Aware Token Pruning for Efficient Audio-Visual Captioning

Add code
Jun 09, 2026
Viaarxiv icon