Picture for Yanwei Cui

Yanwei Cui

Metrics That Write Themselves: Evolving an Evaluator from Its Own Blind Spots

Add code
Aug 19, 2026
Viaarxiv icon

Reconcile Once, Write Anytime: A Trust-Tiered Librarian and a Multi-Agent Writer for Drift-Free, Point-in-Time Research

Add code
Aug 13, 2026
Viaarxiv icon

Who Grades the Grader? Co-Evolving Evaluation Metrics and Skills for Self-Improving LLM Agents

Add code
Jul 14, 2026
Viaarxiv icon

The Blind Curator: How a Biased Judge Silently Disables Skill Retirement in Self-Evolving Agents

Add code
Jul 08, 2026
Viaarxiv icon

Closing the Feedback Loop: From Experience Extraction to Insight Governance in Verbal Reinforcement Learning

Add code
Jun 16, 2026
Viaarxiv icon

Ratchet: A Minimal Hygiene Recipe for Self-Evolving LLM Agents

Add code
May 21, 2026
Viaarxiv icon

Library Drift: Diagnosing and Fixing a Silent Failure Mode in Self-Evolving LLM Skill Libraries

Add code
May 19, 2026
Viaarxiv icon

Hindsight Preference Optimization for Financial Time Series Advisory

Add code
Apr 27, 2026
Viaarxiv icon

Prompt Optimization Is a Coin Flip: Diagnosing When It Helps in Compound AI Systems

Add code
Apr 16, 2026
Viaarxiv icon

Do Agent Rules Shape or Distort? Guardrails Beat Guidance in Coding Agents

Add code
Apr 13, 2026
Viaarxiv icon