Picture for Hamid Dashtbani

Hamid Dashtbani

Random Logit Scaling: Defending Deep Neural Networks Against Black-Box Score-Based Adversarial Example Attacks

Add code
Jul 16, 2026
Viaarxiv icon

TwinBreak: Jailbreaking LLM Security Alignments based on Twin Prompts

Add code
Jun 09, 2025
Figure 1 for TwinBreak: Jailbreaking LLM Security Alignments based on Twin Prompts
Figure 2 for TwinBreak: Jailbreaking LLM Security Alignments based on Twin Prompts
Figure 3 for TwinBreak: Jailbreaking LLM Security Alignments based on Twin Prompts
Figure 4 for TwinBreak: Jailbreaking LLM Security Alignments based on Twin Prompts
Viaarxiv icon