Picture for Eugenia Kim

Eugenia Kim

Beyond "I Can't Help With That": How Child Safety Experts Evaluate AI Chatbot Safety

Add code
Aug 08, 2026
Viaarxiv icon

Psychological Influences of Conversational AI: Research and Design Directions for Reducing Harm and Promoting Well-Being

Add code
Jul 27, 2026
Viaarxiv icon

Pluralis v0.1: Towards a Multicultural, Multimodal, Multilingual Benchmark for AI Risk and Reliability

Add code
Jul 07, 2026
Viaarxiv icon

Learning to Attack and Defend: Adaptive Red Teaming of Language Models via GRPO

Add code
Jun 08, 2026
Viaarxiv icon

DisaBench: A Participatory Evaluation Framework for Disability Harms in Language Models

Add code
May 12, 2026
Viaarxiv icon

XL-SafetyBench: A Country-Grounded Cross-Cultural Benchmark for LLM Safety and Cultural Sensitivity

Add code
May 07, 2026
Viaarxiv icon

Expert Evaluation and the Limits of Human Feedback in Mental Health AI Safety Testing

Add code
Jan 26, 2026
Viaarxiv icon

Seeking Late Night Life Lines: Experiences of Conversational AI Use in Mental Health Crisis

Add code
Dec 29, 2025
Viaarxiv icon

Lessons From Red Teaming 100 Generative AI Products

Add code
Jan 13, 2025
Viaarxiv icon