Picture for Daniel A. Herrmann

Daniel A. Herrmann

Benign interpolation and Occam's razor

Add code
Aug 04, 2026
Viaarxiv icon

Radical AI Interpretability

Add code
Jun 25, 2026
Viaarxiv icon

A Decision-Theoretic Approach for Managing Misalignment

Add code
Dec 21, 2025
Viaarxiv icon

Standards for Belief Representations in LLMs

Add code
May 31, 2024
Viaarxiv icon

Still No Lie Detector for Language Models: Probing Empirical and Conceptual Roadblocks

Add code
Jun 30, 2023
Viaarxiv icon