Picture for Zhuokai Zhao

Zhuokai Zhao

Rethinking Transfer in Continual Learning: A Replay-Based Realisation

Add code
Jul 17, 2026
Viaarxiv icon

SVR-R1: Bootstrapping Multi-modal Reasoning with Self-verification in Reinforcement Learning

Add code
Jul 13, 2026
Viaarxiv icon

Remember When It Matters: Proactive Memory Agent for Long-Horizon Agents

Add code
Jul 09, 2026
Viaarxiv icon

SWE-Together: Evaluating Coding Agents in Interactive User Sessions

Add code
Jun 29, 2026
Viaarxiv icon

SAGE-OPD: Selective Agent-Guided Intervention for Multi-Turn On-Policy Distillation

Add code
Jun 17, 2026
Viaarxiv icon

OmniOPD: Logit-Free On-Policy Distillation via Speculative Verification

Add code
May 31, 2026
Viaarxiv icon

Self-Policy Distillation via Capability-Selective Subspace Projection

Add code
May 21, 2026
Viaarxiv icon

Agentic Recommender System with Hierarchical Belief-State Memory

Add code
May 14, 2026
Viaarxiv icon

Synthetic Sandbox for Training Machine Learning Engineering Agents

Add code
Apr 06, 2026
Viaarxiv icon

LLM-Driven Reasoning for Constraint-Aware Feature Selection in Industrial Systems

Add code
Mar 26, 2026
Viaarxiv icon