Picture for Liyang Chen

Liyang Chen

EffectLearner: World-Aware Object-Effect Reasoning for Real-World Video Object Removal

Add code
Aug 06, 2026
Viaarxiv icon

Breaking the Quality--Intelligibility Trade-off in Streaming Target Speaker Extraction via Deep-Feature-Anchored Preference Optimization

Add code
Jul 11, 2026
Viaarxiv icon

Towards Streaming Target Speaker Extraction via Chunk-wise Interleaved Splicing of Autoregressive Language Model

Add code
Apr 21, 2026
Viaarxiv icon

Seedance 2.0: Advancing Video Generation for World Complexity

Add code
Apr 15, 2026
Viaarxiv icon

DreamID-Omni: Unified Framework for Controllable Human-Centric Audio-Video Generation

Add code
Feb 12, 2026
Viaarxiv icon

AudioRouter: Data Efficient Audio Understanding via RL based Dual Reasoning

Add code
Feb 11, 2026
Viaarxiv icon

OptiSQL: Executable SQL Generation from Optical Tokens

Add code
Jan 21, 2026
Viaarxiv icon

From Inpainting to Editing: A Self-Bootstrapping Framework for Context-Rich Visual Dubbing

Add code
Dec 31, 2025
Viaarxiv icon

Detecting and Mitigating Insertion Hallucination in Video-to-Audio Generation

Add code
Oct 09, 2025
Viaarxiv icon

HuMo: Human-Centric Video Generation via Collaborative Multi-Modal Conditioning

Add code
Sep 10, 2025
Viaarxiv icon