Picture for Diyi Yang

Diyi Yang

Stanford University

The Illusion of Robustness: Aggregate Accuracy Hides Prediction Flips under Task-Irrelevant Context

Add code
Jul 14, 2026
Viaarxiv icon

Will Scaling Improve Social Simulation with LLMs?

Add code
Jul 02, 2026
Viaarxiv icon

Warning labels shift perceptions of sycophantic AI, but not its influence

Add code
Jun 19, 2026
Viaarxiv icon

SkillHarm: Lifecycle-Aware Skill-Based Attacks via Automated Construction

Add code
Jun 01, 2026
Viaarxiv icon

Offloading Score: Measuring AI Reliance Through Counterfactual Workflows

Add code
May 28, 2026
Viaarxiv icon

ProgramBench: Can Language Models Rebuild Programs From Scratch?

Add code
May 05, 2026
Viaarxiv icon

SWE-chat: Coding Agent Interactions From Real Users in the Wild

Add code
Apr 22, 2026
Viaarxiv icon

Generative Experiences for Digital Mental Health Interventions: Evidence from a Randomized Study

Add code
Apr 08, 2026
Viaarxiv icon

Verbalizing LLMs' assumptions to explain and control sycophancy

Add code
Apr 03, 2026
Viaarxiv icon

Practicing with Language Models Cultivates Human Empathic Communication

Add code
Mar 16, 2026
Viaarxiv icon