Picture for Noah Goodman

Noah Goodman

SPIRAL: Learning to Search and Aggregate

Add code
Jun 22, 2026
Viaarxiv icon

A Model of Multi-turn Human Persuadability Using Probabilistic Belief Tracing

Add code
Jun 03, 2026
Viaarxiv icon

Manifold Steering Reveals the Shared Geometry of Neural Network Representation and Behavior

Add code
May 06, 2026
Viaarxiv icon

Poly-EPO: Training Exploratory Reasoning Models

Add code
Apr 19, 2026
Viaarxiv icon

Large Language Model Reasoning Failures

Add code
Feb 05, 2026
Viaarxiv icon

The Singapore Consensus on Global AI Safety Research Priorities

Add code
Jun 25, 2025
Figure 1 for The Singapore Consensus on Global AI Safety Research Priorities
Figure 2 for The Singapore Consensus on Global AI Safety Research Priorities
Figure 3 for The Singapore Consensus on Global AI Safety Research Priorities
Viaarxiv icon

An Approach to Technical AGI Safety and Security

Add code
Apr 02, 2025
Viaarxiv icon

Value Profiles for Encoding Human Variation

Add code
Mar 19, 2025
Viaarxiv icon

Bayesian Preference Elicitation with Language Models

Add code
Mar 08, 2024
Figure 1 for Bayesian Preference Elicitation with Language Models
Figure 2 for Bayesian Preference Elicitation with Language Models
Figure 3 for Bayesian Preference Elicitation with Language Models
Figure 4 for Bayesian Preference Elicitation with Language Models
Viaarxiv icon

Backtracing: Retrieving the Cause of the Query

Add code
Mar 06, 2024
Figure 1 for Backtracing: Retrieving the Cause of the Query
Figure 2 for Backtracing: Retrieving the Cause of the Query
Figure 3 for Backtracing: Retrieving the Cause of the Query
Figure 4 for Backtracing: Retrieving the Cause of the Query
Viaarxiv icon