Picture for Peter Schneider-Kamp

Peter Schneider-Kamp

Write Once, Run Everywhere: The Axon DSL for Shape-Safe and Framework-Agnostic LLM Architectures

Add code
Aug 20, 2026
Viaarxiv icon

DFM Mimir v1: An Open HRM Delivering Frontier Performance at 1B Parameters Using Only Permissible Post-Training Data

Add code
Aug 13, 2026
Viaarxiv icon

The Arbiter Agent: Continually Monitoring Multi-Agent Conversations to Detect Emergent Misalignment

Add code
Jun 09, 2026
Viaarxiv icon

PsychoSafe: Eliciting Psychologically-Informed Refusals in Large Language Models

Add code
Jun 08, 2026
Viaarxiv icon

BrainSurgery: Reproducible and Reliable Declarative Weight Manipulations for Model Editing and Upcycling

Add code
Jun 08, 2026
Viaarxiv icon

LLMs Can Leak Training Data But Do They Want To? A Propensity-Aware Evaluation of Memorization in LLMs

Add code
Jun 04, 2026
Viaarxiv icon

Emergent Languages in Populations of Language Model Agents: From Token Efficiency to Oversight Evasion

Add code
May 29, 2026
Viaarxiv icon

Confidence and Calibration of Activation Oracles for Reliable Interpretation of Language Model Internals

Add code
May 25, 2026
Viaarxiv icon

SommBench: Assessing Sommelier Expertise of Language Models

Add code
Mar 12, 2026
Viaarxiv icon

FlexMoRE: A Flexible Mixture of Rank-heterogeneous Experts for Efficient Federatedly-trained Large Language Models

Add code
Feb 09, 2026
Viaarxiv icon