Picture for Yuji Wang

Yuji Wang

VicEdit: Learning to Edit Videos from Visual In-Context Examples

Add code
Aug 17, 2026
Viaarxiv icon

PersonaShot: Benchmarking Person-Centric Narrative Continuity in Multi-Shot Video Generation

Add code
Aug 17, 2026
Viaarxiv icon

Vidu S1: A Real-Time Interactive Video Generation Model

Add code
Jul 03, 2026
Viaarxiv icon

CineDance: Towards Next-Generation Multi-Shot Long-Form Cinematic Audio-Video Generation

Add code
Jun 08, 2026
Viaarxiv icon

Spatial-Temporal Decoupled Reference Conditioning for Identity-Preserving Text-to-Video Generation

Add code
Jun 01, 2026
Viaarxiv icon

SAFE-Pruner: Semantic Attention-Guided Future-Aware Token Pruning for Efficient Vision-Language-Action Manipulation

Add code
May 28, 2026
Viaarxiv icon

Segment Anything with Motion, Geometry, and Semantic Adaptation for Complex Nonlinear Visual Object Tracking

Add code
May 21, 2026
Viaarxiv icon

TAIHRI: Task-Aware 3D Human Keypoints Localization for Close-Range Human-Robot Interaction

Add code
Apr 10, 2026
Viaarxiv icon

Rethinking IRSTD: Single-Point Supervision Guided Encoder-only Framework is Enough for Infrared Small Target Detection

Add code
Apr 07, 2026
Viaarxiv icon

Embed-RL: Reinforcement Learning for Reasoning-Driven Multimodal Embeddings

Add code
Feb 14, 2026
Viaarxiv icon