Picture for Zewen Liu

Zewen Liu

Evo-Harness: Context-to-Harness Skill Compilation for Self-Evolving Agents

Add code
Aug 15, 2026
Viaarxiv icon

BOUNDARY_SYNC: Measuring Communication-Induced Representational Coupling in Multi-Agent LLM Systems

Add code
Jul 02, 2026
Viaarxiv icon

EPC: A Standardized Protocol for Measuring Evaluator Preference Dynamics in LLM Agent Systems

Add code
Jul 01, 2026
Viaarxiv icon

Mapping the Evaluation Frontier: An Empirical Survey of the Bias-Reliability Tradeoff Across Eleven Evaluator-Agent Conditions

Add code
Jul 01, 2026
Viaarxiv icon

Calibrating the Evaluator: Does Probability Calibration Mitigate Preference Coupling in LLM Agent Feedback Loops?

Add code
Jun 30, 2026
Viaarxiv icon

The Hidden Cost of Resampling: How Imbalance Correction Degrades Probability Calibration in Tree Ensembles

Add code
Jun 29, 2026
Viaarxiv icon

The Contagion Tensor: A Framework for Measuring Output-Distribution Coupling in Multi-Agent LLM Systems -- and Auditing the Claims It Enables

Add code
Jun 27, 2026
Viaarxiv icon

TMP: Tree-structured Mixed-policy Pruning for Large-scale Image Generation and Editing

Add code
Jun 25, 2026
Viaarxiv icon

Memory Contagion: Cross-Temporal Propagation of Evaluator Bias via Agent Memory

Add code
Jun 24, 2026
Viaarxiv icon

Contagion Networks: Evaluator Bias Propagation in Multi-Agent LLM Systems

Add code
Jun 18, 2026
Viaarxiv icon