Picture for Ilias Kazantzidis

Ilias Kazantzidis

Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models

Add code
Jul 14, 2026
Viaarxiv icon