Picture for Yizhuo Jia

Yizhuo Jia

CAPE-T2V: Captioner-Anchored Prompt Enhancement toward Two-Sided Conditioning Alignment in Text-to-Video Generation

Add code
Aug 04, 2026
Viaarxiv icon

CapRiCorn-1K: A Comprehensive Benchmark for Video Captioning and Subject Referential Consistency Across Temporal Scales

Add code
Jun 20, 2026
Viaarxiv icon