Picture for Yongxiang Li

Yongxiang Li

Ripple: Real-Time Streaming Audio-Video Generation With Cross-Modal Recurrent Memory

Add code
Jul 29, 2026
Viaarxiv icon

OmniMate: Open-Ended Real-Time Streaming Audio-Visual Generation for Interactive Avatars

Add code
Jul 25, 2026
Viaarxiv icon

Dual Attention Residuals

Add code
Jul 21, 2026
Viaarxiv icon

A neuromorphic vision system for open-world visual intelligence

Add code
Jul 11, 2026
Viaarxiv icon

CRAFT: A Unified Counterfactual Reasoning Framework for Tabular Question Answering and Fact Verification

Add code
Jun 05, 2026
Viaarxiv icon

Prompt-Level Reward Specifications for Open-Ended Post-Training

Add code
May 28, 2026
Viaarxiv icon

Plant, Persist, Trigger: Sleeper Attack on Large Language Model Agents

Add code
May 27, 2026
Viaarxiv icon

Tibetan-TTS:Low-Resource Tibetan Speech Synthesis with Large Model Adaptation

Add code
May 04, 2026
Viaarxiv icon

Audio-Cogito: Towards Deep Audio Reasoning in Large Audio Language Models

Add code
Apr 14, 2026
Viaarxiv icon

ReasonTabQA: A Comprehensive Benchmark for Table Question Answering from Real World Industrial Scenarios

Add code
Jan 12, 2026
Viaarxiv icon