Picture for Yunyun Han

Yunyun Han

DASH: Divergence-Adaptive Supervision Horizons for On-Policy Self-Distillation of Reasoning Models

Add code
Aug 07, 2026
Viaarxiv icon

SkillCorpus: Consolidating and Evaluating the Open Skill Ecosystem for Real-World LLM Agents

Add code
Jul 23, 2026
Viaarxiv icon

EvoAgentBench: Benchmarking Agent Self-Evolution via Ability Transfer

Add code
Jul 06, 2026
Viaarxiv icon

MIND: Unified Inquiry and Diagnosis RL with Criteria Grounded Clinical Supports for Psychiatric Consultation

Add code
Mar 04, 2026
Viaarxiv icon

LingxiDiagBench: A Multi-Agent Framework for Benchmarking LLMs in Chinese Psychiatric Consultation and Diagnosis

Add code
Feb 11, 2026
Viaarxiv icon

EverMemBench: Benchmarking Long-Term Interactive Memory in Large Language Models

Add code
Feb 03, 2026
Viaarxiv icon