Picture for Yicheng Xiao

Yicheng Xiao

JoyAI-Video-Edit: Real-Time Open-Ended Video Editing with Autoregressive Diffusion

Add code
Aug 04, 2026
Viaarxiv icon

PixVL: Self-Supervised Training of Pixel-Level MLLMs via a Unified Mask--Text Consistency Cycle

Add code
Aug 02, 2026
Viaarxiv icon

IV-CoT: Implicit Visual Chain-of-Thought for Structure-Aware Text-to-Image Generation

Add code
Jun 23, 2026
Viaarxiv icon

LongLive-2.0: An NVFP4 Parallel Infrastructure for Long Video Generation

Add code
May 19, 2026
Viaarxiv icon

Awaking Spatial Intelligence in Unified Multimodal Understanding and Generation

Add code
May 05, 2026
Viaarxiv icon

SpatialEdit: Benchmarking Fine-Grained Image Spatial Editing

Add code
Apr 06, 2026
Viaarxiv icon

PixCLIP: Achieving Fine-grained Visual Language Understanding via Any-granularity Pixel-Text Alignment Learning

Add code
Nov 06, 2025
Viaarxiv icon

LongLive: Real-time Interactive Long Video Generation

Add code
Sep 26, 2025
Viaarxiv icon

Accelerating Parallel Diffusion Model Serving with Residual Compression

Add code
Jul 23, 2025
Viaarxiv icon

LoRA-Gen: Specializing Large Language Model via Online LoRA Generation

Add code
Jun 13, 2025
Figure 1 for LoRA-Gen: Specializing Large Language Model via Online LoRA Generation
Figure 2 for LoRA-Gen: Specializing Large Language Model via Online LoRA Generation
Figure 3 for LoRA-Gen: Specializing Large Language Model via Online LoRA Generation
Figure 4 for LoRA-Gen: Specializing Large Language Model via Online LoRA Generation
Viaarxiv icon