Picture for Yulia Tsvetkov

Yulia Tsvetkov

Rethinking the Evaluation of Harness Evolution for Agents

Add code
Jul 14, 2026
Viaarxiv icon

Moral Safety in LLMs: Exposing Performative Compliance with Puzzled Cues

Add code
Jun 30, 2026
Viaarxiv icon

Multilingual Reasoning Cascades Need More Context

Add code
Jun 25, 2026
Viaarxiv icon

Scaling Participation in Modular AI Systems

Add code
Jun 05, 2026
Viaarxiv icon

EvoLM: Self-Evolving Language Models through Co-Evolved Discriminative Rubrics

Add code
May 05, 2026
Viaarxiv icon

Ads in AI Chatbots? An Analysis of How Large Language Models Navigate Conflicts of Interest

Add code
Apr 09, 2026
Viaarxiv icon

IDIOLEX: Unified and Continuous Representations for Idiolectal and Stylistic Variation

Add code
Apr 06, 2026
Viaarxiv icon

Cold-Start Personalization via Training-Free Priors from Structured World Models

Add code
Feb 16, 2026
Viaarxiv icon

Small Reward Models via Backward Inference

Add code
Feb 14, 2026
Viaarxiv icon

Are Language Models Sensitive to Morally Irrelevant Distractors?

Add code
Feb 10, 2026
Viaarxiv icon