Picture for Yuhao Shen

Yuhao Shen

GuideSkill: Evolving Executable LLM Agent Skills for Guideline-Grounded Clinical Reasoning

Add code
Jul 28, 2026
Viaarxiv icon

OmniDelta: Skill-Driven Budget Allocation for Token Compression in OmniLLMs

Add code
Jul 28, 2026
Viaarxiv icon

SEED: Self-Evolving On-Policy Distillation for Agentic Reinforcement Learning

Add code
Jul 16, 2026
Viaarxiv icon

D-cut: Adaptive Verification Depth Pruning for Batched Speculative Decoding

Add code
Jul 16, 2026
Viaarxiv icon

OPID: On-Policy Skill Distillation for Agentic Reinforcement Learning

Add code
Jun 25, 2026
Viaarxiv icon

Breaking Entropy Bounds: Accelerating RL Training via MTP with Rejection Sampling

Add code
Jun 10, 2026
Viaarxiv icon

Beyond Prompt-Based Planning: MCP-Native Graph Planning-based Biomedical Agent System

Add code
Jun 03, 2026
Viaarxiv icon

MedGuideX: Internalizing Decision Logic from Executable Guidelines into Large Language Models for Clinical Reasoning

Add code
May 26, 2026
Viaarxiv icon

Maestro: Reinforcement Learning to Orchestrate Hierarchical Model-Skill Ensembles

Add code
May 21, 2026
Viaarxiv icon

Draft Less, Retrieve More: Hybrid Tree Construction for Speculative Decoding

Add code
May 19, 2026
Viaarxiv icon