Picture for Will Hawkins

Will Hawkins

The Heterogeneous Safety Impacts of Benign Multilingual Fine-Tuning

Add code
Jun 27, 2026
Viaarxiv icon

Evaluating Language Models for Harmful Manipulation

Add code
Mar 26, 2026
Viaarxiv icon

Deepfakes on Demand: the rise of accessible non-consensual deepfake image generators

Add code
May 06, 2025
Viaarxiv icon

The effect of fine-tuning on language model toxicity

Add code
Oct 21, 2024
Figure 1 for The effect of fine-tuning on language model toxicity
Figure 2 for The effect of fine-tuning on language model toxicity
Figure 3 for The effect of fine-tuning on language model toxicity
Figure 4 for The effect of fine-tuning on language model toxicity
Viaarxiv icon

Imagen 3

Add code
Aug 13, 2024
Viaarxiv icon

Holistic Safety and Responsibility Evaluations of Advanced AI Models

Add code
Apr 22, 2024
Viaarxiv icon

Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context

Add code
Mar 08, 2024
Viaarxiv icon

Gemini: A Family of Highly Capable Multimodal Models

Add code
Dec 19, 2023
Viaarxiv icon

The ethical ambiguity of AI data enrichment: Measuring gaps in research ethics norms and practices

Add code
Jun 01, 2023
Viaarxiv icon

Model evaluation for extreme risks

Add code
May 24, 2023
Figure 1 for Model evaluation for extreme risks
Figure 2 for Model evaluation for extreme risks
Figure 3 for Model evaluation for extreme risks
Figure 4 for Model evaluation for extreme risks
Viaarxiv icon