Picture for Xiangyang Luo

Xiangyang Luo

Exposure Bias Can Alleviate Itself via Directional and Frequency Rectification in Flow Matching

Add code
Jun 26, 2026
Viaarxiv icon

DataClaw0: Agentic Tailoring Multimodal Data from Raw Streams

Add code
Jun 19, 2026
Viaarxiv icon

TetherCache: Stabilizing Autoregressive Long-Form Video Generation with Gated Recall and Trusted Alignment

Add code
Jun 11, 2026
Viaarxiv icon

When Vision Misleads, Let Location Speak: A Worldwide Image Geo-Localization Method via Location Attention Mechanism and Large Multimodal Models

Add code
Jun 08, 2026
Viaarxiv icon

IP-Adapter Is All You Need: Towards Fine-Tuning-Free Diffusion-Based Talking Face Generation

Add code
May 28, 2026
Viaarxiv icon

DualGeo: A Dual-View Framework for Worldwide Image Geo-localization

Add code
Apr 28, 2026
Viaarxiv icon

CoInteract: Physically-Consistent Human-Object Interaction Video Synthesis via Spatially-Structured Co-Generation

Add code
Apr 21, 2026
Viaarxiv icon

Beyond the Golden Data: Resolving the Motion-Vision Quality Dilemma via Timestep Selective Training

Add code
Mar 26, 2026
Viaarxiv icon

AEGPO: Adaptive Entropy-Guided Policy Optimization for Diffusion Models

Add code
Feb 06, 2026
Viaarxiv icon

CIEC: Coupling Implicit and Explicit Cues for Multimodal Weakly Supervised Manipulation Localization

Add code
Feb 03, 2026
Viaarxiv icon