Picture for Adam Oberman

Adam Oberman

Efficient Safety Alignment of Language Models via Latent Personality Traits

Add code
Jul 08, 2026
Viaarxiv icon

How Much is Left? LLMs Linearly Encode Their Remaining Output Length

Add code
Jul 06, 2026
Viaarxiv icon

Safety from Honesty in a Disinterested AI Predictor

Add code
Jun 28, 2026
Viaarxiv icon

Beyond Scalar Rewards: An Axiomatic Framework for Lexicographic MDPs

Add code
May 17, 2025
Viaarxiv icon

Superintelligent Agents Pose Catastrophic Risks: Can Scientist AI Offer a Safer Path?

Add code
Feb 21, 2025
Viaarxiv icon

Can Safety Fine-Tuning Be More Principled? Lessons Learned from Cybersecurity

Add code
Jan 19, 2025
Viaarxiv icon

Addressing Sample Inefficiency in Multi-View Representation Learning

Add code
Dec 17, 2023
Figure 1 for Addressing Sample Inefficiency in Multi-View Representation Learning
Figure 2 for Addressing Sample Inefficiency in Multi-View Representation Learning
Figure 3 for Addressing Sample Inefficiency in Multi-View Representation Learning
Figure 4 for Addressing Sample Inefficiency in Multi-View Representation Learning
Viaarxiv icon

EuclidNets: An Alternative Operation for Efficient Inference of Deep Learning Models

Add code
Dec 22, 2022
Viaarxiv icon

A Reproducible and Realistic Evaluation of Partial Domain Adaptation Methods

Add code
Oct 03, 2022
Figure 1 for A Reproducible and Realistic Evaluation of Partial Domain Adaptation Methods
Figure 2 for A Reproducible and Realistic Evaluation of Partial Domain Adaptation Methods
Figure 3 for A Reproducible and Realistic Evaluation of Partial Domain Adaptation Methods
Figure 4 for A Reproducible and Realistic Evaluation of Partial Domain Adaptation Methods
Viaarxiv icon

On the Generalization of Representations in Reinforcement Learning

Add code
Mar 01, 2022
Figure 1 for On the Generalization of Representations in Reinforcement Learning
Figure 2 for On the Generalization of Representations in Reinforcement Learning
Figure 3 for On the Generalization of Representations in Reinforcement Learning
Figure 4 for On the Generalization of Representations in Reinforcement Learning
Viaarxiv icon