Picture for Haoxu Wang

Haoxu Wang

Beyond Reconstruction: Full-Context Generative DiT for Music Generation

Add code
Aug 11, 2026
Viaarxiv icon

Qwen-Audio-3.0-TTS: Freely Controllable and Highly Robust Speech Synthesis with Multi-Stage Training Paradigm

Add code
Jul 27, 2026
Viaarxiv icon

Pushing the Frontier of Full-Song Generation: Hierarchical Autoregressive Planning Meets Flow-Matching Rendering

Add code
Jul 23, 2026
Viaarxiv icon

Vidu S1: A Real-Time Interactive Video Generation Model

Add code
Jul 03, 2026
Viaarxiv icon

FlowTTS-GRPO: Online Reinforcement Learning with Multi-Objective Reward Optimization for Flow-Matching Based Text-to-Speech

Add code
Jun 22, 2026
Viaarxiv icon

KernelBench-X: A Comprehensive Benchmark for Evaluating LLM-Generated GPU Kernels

Add code
May 06, 2026
Viaarxiv icon

SageBwd: A Trainable Low-bit Attention

Add code
Mar 02, 2026
Viaarxiv icon

SLA2: Sparse-Linear Attention with Learnable Routing and QAT

Add code
Feb 13, 2026
Viaarxiv icon

LuSeeL: Language-queried Binaural Universal Sound Event Extraction and Localization

Add code
Jan 27, 2026
Viaarxiv icon

E2E-AEC: Implementing an end-to-end neural network learning approach for acoustic echo cancellation

Add code
Jan 23, 2026
Viaarxiv icon