Picture for Peiyang He

Peiyang He

Metrics That Write Themselves: Evolving an Evaluator from Its Own Blind Spots

Add code
Aug 19, 2026
Viaarxiv icon

Reconcile Once, Write Anytime: A Trust-Tiered Librarian and a Multi-Agent Writer for Drift-Free, Point-in-Time Research

Add code
Aug 13, 2026
Viaarxiv icon

Who Grades the Grader? Co-Evolving Evaluation Metrics and Skills for Self-Improving LLM Agents

Add code
Jul 14, 2026
Viaarxiv icon

The Blind Curator: How a Biased Judge Silently Disables Skill Retirement in Self-Evolving Agents

Add code
Jul 08, 2026
Viaarxiv icon

Closing the Feedback Loop: From Experience Extraction to Insight Governance in Verbal Reinforcement Learning

Add code
Jun 16, 2026
Viaarxiv icon

Better Literary Translation: A Multi-Aspect Data Generation and LLM Training Approach

Add code
Jun 04, 2026
Viaarxiv icon

Ratchet: A Minimal Hygiene Recipe for Self-Evolving LLM Agents

Add code
May 21, 2026
Viaarxiv icon

Library Drift: Diagnosing and Fixing a Silent Failure Mode in Self-Evolving LLM Skill Libraries

Add code
May 19, 2026
Viaarxiv icon

Hindsight Preference Optimization for Financial Time Series Advisory

Add code
Apr 27, 2026
Viaarxiv icon

Prompt Optimization Is a Coin Flip: Diagnosing When It Helps in Compound AI Systems

Add code
Apr 16, 2026
Viaarxiv icon