Picture for Xudong Han

Xudong Han

RoutePack: Expert Placement and Attention-Aware Data Packing for MoE Reinforcement Learning

Add code
Aug 12, 2026
Viaarxiv icon

SurakshaEval: An Indic Safety Benchmark for Multilingual LLMs

Add code
Aug 08, 2026
Viaarxiv icon

Ling and Ring 2.6 Technical Report: Efficient and Instant Agentic Intelligence at Trillion-Parameter Scale

Add code
Jun 13, 2026
Viaarxiv icon

Self-Induced Outcome Potential: Turn-Level Credit Assignment for Agents without Verifiers

Add code
May 06, 2026
Viaarxiv icon

Controllable Reasoning Models Are Private Thinkers

Add code
Feb 27, 2026
Viaarxiv icon

DSP-Reg: Domain-Sensitive Parameter Regularization for Robust Domain Generalization

Add code
Jan 27, 2026
Viaarxiv icon

Event Extraction in Large Language Model

Add code
Dec 22, 2025
Viaarxiv icon

Every Step Evolves: Scaling Reinforcement Learning for Trillion-Scale Thinking Model

Add code
Oct 21, 2025
Figure 1 for Every Step Evolves: Scaling Reinforcement Learning for Trillion-Scale Thinking Model
Figure 2 for Every Step Evolves: Scaling Reinforcement Learning for Trillion-Scale Thinking Model
Figure 3 for Every Step Evolves: Scaling Reinforcement Learning for Trillion-Scale Thinking Model
Figure 4 for Every Step Evolves: Scaling Reinforcement Learning for Trillion-Scale Thinking Model
Viaarxiv icon

Distribution-Aligned Decoding for Efficient LLM Task Adaptation

Add code
Sep 19, 2025
Viaarxiv icon

K2-Think: A Parameter-Efficient Reasoning System

Add code
Sep 09, 2025
Viaarxiv icon