Picture for Xiting Wang

Xiting Wang

Self-Improving Large Language Models via Progressive Experience Evolution

Add code
Aug 03, 2026
Viaarxiv icon

LEEPS: Latent-Guided Explore-Exploit Prompt Sampling for Efficient RLVR in Large Language Models

Add code
Jul 30, 2026
Viaarxiv icon

Do LLMs Know Their Vulnerable Scenarios?

Add code
Jul 26, 2026
Viaarxiv icon

Distill Where the Student Goes: Teacher-Regularized RL for English-Evidence Cross-Lingual RAG

Add code
Jul 03, 2026
Viaarxiv icon

C$^{2}$R: Cross-sample Consistency Regularization Mitigates Feature Splitting and Absorption in Sparse Autoencoders

Add code
Jun 29, 2026
Viaarxiv icon

Extreme Region Policy Distillation

Add code
May 25, 2026
Viaarxiv icon

TAD: Temporal-Aware Trajectory Self-Distillation for Fast and Accurate Diffusion LLM

Add code
May 10, 2026
Viaarxiv icon

Toward Personalized LLM-Powered Agents: Foundations, Evaluation, and Future Directions

Add code
Feb 26, 2026
Viaarxiv icon

Efficient and Stable Reinforcement Learning for Diffusion Language Models

Add code
Feb 09, 2026
Viaarxiv icon

Unlocking Implicit Experience: Synthesizing Tool-Use Trajectories from Text

Add code
Jan 15, 2026
Viaarxiv icon