Picture for Saadia Gabriel

Saadia Gabriel

PM-Bench: Evaluating Prospective Memory in LLM Agents

Add code
Jul 14, 2026
Viaarxiv icon

OpenThoughts-Agent: Data Recipes for Agentic Models

Add code
Jun 23, 2026
Viaarxiv icon

When Can LLMs Learn to Reason with Weak Supervision?

Add code
Apr 20, 2026
Viaarxiv icon

SUPERNOVA: Eliciting General Reasoning in LLMs with Reinforcement Learning on Natural Instructions

Add code
Apr 09, 2026
Viaarxiv icon

Multi-Objective Alignment of Language Models for Personalized Psychotherapy

Add code
Feb 17, 2026
Viaarxiv icon

Translation as a Scalable Proxy for Multilingual Evaluation

Add code
Jan 16, 2026
Viaarxiv icon

OpenThoughts: Data Recipes for Reasoning Models

Add code
Jun 05, 2025
Viaarxiv icon

X-Teaming: Multi-Turn Jailbreaks and Defenses with Adaptive Multi-Agents

Add code
Apr 15, 2025
Viaarxiv icon

MOSAIC: Modeling Social AI for Content Dissemination and Regulation in Multi-Agent Simulations

Add code
Apr 10, 2025
Figure 1 for MOSAIC: Modeling Social AI for Content Dissemination and Regulation in Multi-Agent Simulations
Figure 2 for MOSAIC: Modeling Social AI for Content Dissemination and Regulation in Multi-Agent Simulations
Figure 3 for MOSAIC: Modeling Social AI for Content Dissemination and Regulation in Multi-Agent Simulations
Figure 4 for MOSAIC: Modeling Social AI for Content Dissemination and Regulation in Multi-Agent Simulations
Viaarxiv icon

Disparities in LLM Reasoning Accuracy and Explanations: A Case Study on African American English

Add code
Mar 06, 2025
Viaarxiv icon