Picture for Alizishaan Khatri

Alizishaan Khatri

Probing the Prefill: Detecting Code Vulnerabilities via Latent Activations

Add code
Aug 17, 2026
Viaarxiv icon

Do All LLMs Know When They're Being Harmful? A Reproducibility Study of Latent-Space Safety Probes Across Model Families

Add code
Aug 08, 2026
Viaarxiv icon