Picture for Bin Xia

Bin Xia

LoTA-N2N: Local Trace Adaptation for Zero-Shot Self-Supervised Image Denoising

Add code
Jul 27, 2026
Viaarxiv icon

Reflect-R1: Evidence-Driven Reflection for Self-Correction in Long Video Understanding

Add code
Jun 30, 2026
Viaarxiv icon

UnityShots: Memory-Driven Multi-Shot Audio-Video Generation with Boundary-Aware Gating

Add code
Jun 19, 2026
Viaarxiv icon

FastMix: Fast Data Mixture Optimization via Gradient Descent

Add code
Jun 12, 2026
Viaarxiv icon

Three-dimensional Conditional Diffusion Models for Cosmological 21 cm Lightcone Emulation

Add code
May 27, 2026
Viaarxiv icon

AVBench: Human-Aligned and Automated Evaluation Benchmark for Audio-Video Generative Models

Add code
May 23, 2026
Viaarxiv icon

Divide and Conquer: Decoupled Representation Alignment for Multimodal World Models

Add code
May 03, 2026
Viaarxiv icon

Agentic World Modeling: Foundations, Capabilities, Laws, and Beyond

Add code
Apr 24, 2026
Viaarxiv icon

Index-ASR Technical Report

Add code
Dec 31, 2025
Viaarxiv icon

DreamOmni3: Scribble-based Editing and Generation

Add code
Dec 27, 2025
Viaarxiv icon