Picture for Zhao Yang

Zhao Yang

SkillReason: Reasoning-Enhanced Agent Skill Retrieval for Implicit User Requests

Add code
Aug 09, 2026
Viaarxiv icon

Agentic Reinforcement Learning with Observation-Calibrated Self-Distillation

Add code
Aug 05, 2026
Viaarxiv icon

Hermite Curves as Trajectory Priors for Vision-Language-Action Models

Add code
Aug 02, 2026
Viaarxiv icon

ChunkFlow: Towards Continuity-Consistent Chunked Policy Learning

Add code
Jul 14, 2026
Viaarxiv icon

Modularized Reinforcement Learning on LLMs: From MDP Creation to Exploration and Learning

Add code
Jun 20, 2026
Viaarxiv icon

VeriGraph: Towards Verifiable Data-Analytic Agents

Add code
Jun 15, 2026
Viaarxiv icon

Biological Reasoning-Informed Regression for Interpretable Regulatory DNA Activity Prediction

Add code
Jun 06, 2026
Viaarxiv icon

Reinforcement Learning from Cross-domain Videos with Video Prediction Model

Add code
Jun 03, 2026
Viaarxiv icon

CityGen: Structure-Guided City-Style Synthesis for Cross-City Autonomous Driving

Add code
May 28, 2026
Viaarxiv icon

A Heterogeneous Temporal Memory Governance Framework for Long-Term LLM Persona Consistency

Add code
May 14, 2026
Viaarxiv icon