Picture for Changwen Zheng

Changwen Zheng

GUPO: Gradient Uncertainty-aware Policy Optimization for Post-Training Large Language Models

Add code
Aug 18, 2026
Viaarxiv icon

Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning

Add code
Aug 13, 2026
Viaarxiv icon

Ground-Truth Neighborhood Regularization for Reinforcement Learning Post-Training of Time Series Foundation Models

Add code
Aug 08, 2026
Viaarxiv icon

Dirichlet-Guided Group Forecasting for Alleviating Over-smoothing in Time Series Forecasting

Add code
Jun 09, 2026
Viaarxiv icon

Generalizing Graph Foundation Models via Hyperbolic Retrieval-Augmented Generation

Add code
Jun 03, 2026
Viaarxiv icon

PAPO-VLA: Planning-Aware Policy Optimization for Vision-Language-Action Models

Add code
May 19, 2026
Viaarxiv icon

TIDE-Bench: Task-Aware and Diagnostic Evaluation of Tool-Integrated Reasoning

Add code
May 10, 2026
Viaarxiv icon

CAMD: Coverage-Aware Multimodal Decoding for Efficient Reasoning of Multimodal Large Language Models

Add code
Mar 16, 2026
Viaarxiv icon

Closing the Loop: A Control-Theoretic Framework for Provably Stable Time Series Forecasting with LLMs

Add code
Feb 13, 2026
Viaarxiv icon

Adaptive Uncertainty-Aware Tree Search for Robust Reasoning

Add code
Feb 06, 2026
Viaarxiv icon