Picture for Xingyu Zhang

Xingyu Zhang

GUPO: Gradient Uncertainty-aware Policy Optimization for Post-Training Large Language Models

Add code
Aug 18, 2026
Viaarxiv icon

Ground-Truth Neighborhood Regularization for Reinforcement Learning Post-Training of Time Series Foundation Models

Add code
Aug 08, 2026
Viaarxiv icon

TacPrint: A Wearable Fingertip Tactile Sensor for Human-to-Robot Contact Reproduction

Add code
Jul 31, 2026
Viaarxiv icon

Dirichlet-Guided Group Forecasting for Alleviating Over-smoothing in Time Series Forecasting

Add code
Jun 09, 2026
Viaarxiv icon

UniCreative: Unifying Long-form Logic and Short-form Sparkle via Reference-Free Reinforcement Learning

Add code
Apr 07, 2026
Viaarxiv icon

DBMIF: a deep balanced multimodal iterative fusion framework for air- and bone-conduction speech enhancement

Add code
Mar 03, 2026
Viaarxiv icon

Closing the Loop: A Control-Theoretic Framework for Provably Stable Time Series Forecasting with LLMs

Add code
Feb 13, 2026
Viaarxiv icon

DexTac: Learning Contact-aware Visuotactile Policies via Hand-by-hand Teaching

Add code
Jan 29, 2026
Viaarxiv icon

Purification Before Fusion: Toward Mask-Free Speech Enhancement for Robust Audio-Visual Speech Recognition

Add code
Jan 18, 2026
Viaarxiv icon

Causality-Aware Temporal Projection for Video Understanding in Video-LLMs

Add code
Jan 05, 2026
Viaarxiv icon