Picture for Alice Oh

Alice Oh

KAIST

EduZone: A Framework for Evaluating LLM Safety for K-12 Students and Teachers

Add code
Aug 03, 2026
Viaarxiv icon

Solar Open 2 Technical Report

Add code
Jul 24, 2026
Viaarxiv icon

Pluralis v0.1: Towards a Multicultural, Multimodal, Multilingual Benchmark for AI Risk and Reliability

Add code
Jul 07, 2026
Viaarxiv icon

Cross-National Information Attacks: A Two-Decade Analysis of Troll Behavior in Korea

Add code
Jun 22, 2026
Viaarxiv icon

Not What, But How: A Framework for Auditing LLM Responses across Positioning, Generalization, Anthromorphism, and Maxims

Add code
Jun 03, 2026
Viaarxiv icon

Not What, But How: A Communicative Audit of LLM Response Framing

Add code
Jun 01, 2026
Viaarxiv icon

JuICE: A Benchmark for Evaluating LLM-Judge in Identifying Cultural Errors

Add code
May 26, 2026
Viaarxiv icon

LoCar: Localization-Aware Evaluation of In-Vehicle Assistants through Fine-Grained Sociolinguistic Control

Add code
May 20, 2026
Viaarxiv icon

On the limits and opportunities of AI reviewers: Reviewing the reviews of Nature-family papers with 45 expert scientists

Add code
May 20, 2026
Viaarxiv icon

SemEval-2026 Task 7: Everyday Knowledge Across Diverse Languages and Cultures

Add code
May 04, 2026
Viaarxiv icon