Picture for Boyun Zhang

Boyun Zhang

Auto-AEG: Scalable Data Construction for Open-Vocabulary Audio Event Grounding

Add code
Jul 05, 2026
Viaarxiv icon

EVOM: Agentic Meta-Evolution of Actor-Critic Architectures for Reinforcement Learning

Add code
Jun 24, 2026
Viaarxiv icon

HVD: Human Vision-Driven Video Representation Learning for Text-Video Retrieval

Add code
Jan 22, 2026
Viaarxiv icon

Delving Deeper: Hierarchical Visual Perception for Robust Video-Text Retrieval

Add code
Jan 19, 2026
Viaarxiv icon