Picture for Xuying Zhang

Xuying Zhang

JoyAI-Video-Edit: Real-Time Open-Ended Video Editing with Autoregressive Diffusion

Add code
Aug 04, 2026
Viaarxiv icon

DreamStyle3D: Efficient 3D Stylized Asset Generation via Dual-Attention Disentanglement

Add code
Jul 27, 2026
Viaarxiv icon

Self Gradient Forcing: Native Long Video Extrapolation

Add code
Jul 24, 2026
Viaarxiv icon

Skywork UniPic 3.0: Unified Multi-Image Composition via Sequence Modeling

Add code
Jan 22, 2026
Viaarxiv icon

OmniSegmentor: A Flexible Multi-Modal Learning Framework for Semantic Segmentation

Add code
Sep 18, 2025
Viaarxiv icon

AR-1-to-3: Single Image to Consistent 3D Object Generation via Next-View Prediction

Add code
Mar 17, 2025
Viaarxiv icon

TAR3D: Creating High-Quality 3D Assets via Next-Part Prediction

Add code
Dec 22, 2024
Figure 1 for TAR3D: Creating High-Quality 3D Assets via Next-Part Prediction
Figure 2 for TAR3D: Creating High-Quality 3D Assets via Next-Part Prediction
Figure 3 for TAR3D: Creating High-Quality 3D Assets via Next-Part Prediction
Figure 4 for TAR3D: Creating High-Quality 3D Assets via Next-Part Prediction
Viaarxiv icon

VP-MEL: Visual Prompts Guided Multimodal Entity Linking

Add code
Dec 10, 2024
Figure 1 for VP-MEL: Visual Prompts Guided Multimodal Entity Linking
Figure 2 for VP-MEL: Visual Prompts Guided Multimodal Entity Linking
Figure 3 for VP-MEL: Visual Prompts Guided Multimodal Entity Linking
Figure 4 for VP-MEL: Visual Prompts Guided Multimodal Entity Linking
Viaarxiv icon

Adaptive Guidance Learning for Camouflaged Object Detection

Add code
May 07, 2024
Figure 1 for Adaptive Guidance Learning for Camouflaged Object Detection
Figure 2 for Adaptive Guidance Learning for Camouflaged Object Detection
Figure 3 for Adaptive Guidance Learning for Camouflaged Object Detection
Figure 4 for Adaptive Guidance Learning for Camouflaged Object Detection
Viaarxiv icon

TeMO: Towards Text-Driven 3D Stylization for Multi-Object Meshes

Add code
Dec 07, 2023
Viaarxiv icon