Picture for Yihang Chen

Yihang Chen

When Should Active RAG Retrieve? A Budget-Aware Evaluation of Utility, Calibration, and Cost

Add code
Jul 27, 2026
Viaarxiv icon

Toward User-Conditioned Evaluation of Personal LLM Agents under Temporal Interventions

Add code
Jul 20, 2026
Viaarxiv icon

The Path to Self-Evolving Clinical Systems: Scaling Medical Agents from Assistance to Autonomy

Add code
Jul 13, 2026
Viaarxiv icon

Operational Reframing and Approval-Framed Delegation in Multi-Agent LLM Safety

Add code
Jul 08, 2026
Viaarxiv icon

MeGAS: Thermomechanical Dynamic Gaussian Splatting for Thermophysical Scene Editing

Add code
Jun 22, 2026
Viaarxiv icon

Beyond Simpson's Paradox: A Cascade of Confounders in AI Agent Pull-Request Co-Authorship

Add code
Jun 21, 2026
Viaarxiv icon

A Unifying Lens on Supervised Fine-Tuning Through Target Distribution Design

Add code
Jun 09, 2026
Viaarxiv icon

When Safe Skills Collide: Measuring Compositional Risk in Agent Skill Ecosystems

Add code
May 30, 2026
Viaarxiv icon

Relevant Is Not Warranted: Evidence-Force Calibration for Cited RAG

Add code
May 27, 2026
Viaarxiv icon

Does RAG Know When Retrieval Is Wrong? Diagnosing Context Compliance under Knowledge Conflict

Add code
May 14, 2026
Viaarxiv icon