Picture for Chaoqun Cui

Chaoqun Cui

Enhancing Gaze Reasoning in Vision Foundation Models for Gaze Following

Add code
May 21, 2026
Viaarxiv icon

Avoiding Over-smoothing in Social Media Rumor Detection with Pre-trained Propagation Tree Transformer

Add code
Mar 24, 2026
Viaarxiv icon

CineSRD: Leveraging Visual, Acoustic, and Linguistic Cues for Open-World Visual Media Speaker Diarization

Add code
Mar 17, 2026
Viaarxiv icon

From Utterance to Vividity: Training Expressive Subtitle Translation LLM via Adaptive Local Preference Optimization

Add code
Feb 01, 2026
Viaarxiv icon

Hermes the Polyglot: A Unified Framework to Enhance Expressiveness for Multimodal Interlingual Subtitling

Add code
Jan 31, 2026
Viaarxiv icon

Agentic Reward Modeling: Verifying GUI Agent via Online Proactive Interaction

Add code
Jan 31, 2026
Viaarxiv icon

VL4Gaze: Unleashing Vision-Language Models for Gaze Following

Add code
Dec 23, 2025
Viaarxiv icon

Fine-grained Video Dubbing Duration Alignment with Segment Supervised Preference Optimization

Add code
Aug 12, 2025
Viaarxiv icon

Towards Real-World Rumor Detection: Anomaly Detection Framework with Graph Supervised Contrastive Learning

Add code
Aug 10, 2025
Viaarxiv icon

Propagation Tree Is Not Deep: Adaptive Graph Contrastive Learning Approach for Rumor Detection

Add code
Aug 10, 2025
Viaarxiv icon