Picture for Yuhang Tian

Yuhang Tian

How Much, Then Where: Credit-Conserving Action-to-Token Allocation for Multi-Turn Agent Reinforcement Learning

Add code
Aug 07, 2026
Viaarxiv icon

HarnessCompass: Guiding Automatic Harness Evolution toward Generalizable and Effective Agent Harnesses

Add code
Aug 03, 2026
Viaarxiv icon

Overview of the NLPCC 2026 Shared Task 1: Difficulty-Aware Multilingual and Multimodal Medical Instructional Video Understanding Evaluation

Add code
Jul 07, 2026
Viaarxiv icon

PruneTIR: Inference-Time Tool Call Pruning for Effective yet Efficient Tool-Integrated Reasoning

Add code
May 11, 2026
Viaarxiv icon

ActiShade: Activating Overshadowed Knowledge to Guide Multi-Hop Reasoning in Large Language Models

Add code
Jan 12, 2026
Viaarxiv icon

Overview of the NLPCC 2025 Shared Task 4: Multi-modal, Multilingual, and Multi-hop Medical Instructional Video Question Answering Challenge

Add code
May 11, 2025
Viaarxiv icon

RefineCoder: Iterative Improving of Large Language Models via Adaptive Critique Refinement for Code Generation

Add code
Feb 13, 2025
Viaarxiv icon

FLVoogd: Robust And Privacy Preserving Federated Learning

Add code
Jun 24, 2022
Figure 1 for FLVoogd: Robust And Privacy Preserving Federated Learning
Figure 2 for FLVoogd: Robust And Privacy Preserving Federated Learning
Figure 3 for FLVoogd: Robust And Privacy Preserving Federated Learning
Figure 4 for FLVoogd: Robust And Privacy Preserving Federated Learning
Viaarxiv icon