Picture for Yuhang Zhou

Yuhang Zhou

Remember When It Matters: Proactive Memory Agent for Long-Horizon Agents

Add code
Jul 09, 2026
Viaarxiv icon

TurnOPD: Making On-Policy Distillation Turn-Aware for Efficient Long-Horizon Agent Training

Add code
Jul 07, 2026
Viaarxiv icon

COMFYCLAW: Self-Evolving Skill Harnesses for Image Generation Workflows

Add code
Jul 02, 2026
Viaarxiv icon

SAGE-OPD: Selective Agent-Guided Intervention for Multi-Turn On-Policy Distillation

Add code
Jun 17, 2026
Viaarxiv icon

From Correctness to Utility: Gain-Based Prefix Evaluation for LLM Reasoning

Add code
Jun 05, 2026
Viaarxiv icon

OmniOPD: Logit-Free On-Policy Distillation via Speculative Verification

Add code
May 31, 2026
Viaarxiv icon

Agentic Recommender System with Hierarchical Belief-State Memory

Add code
May 14, 2026
Viaarxiv icon

Deep Reprogramming Distillation for Medical Foundation Models

Add code
May 06, 2026
Viaarxiv icon

CAR: Query-Guided Confidence-Aware Reranking for Retrieval-Augmented Generation

Add code
May 06, 2026
Viaarxiv icon

Synthetic Sandbox for Training Machine Learning Engineering Agents

Add code
Apr 06, 2026
Viaarxiv icon