Picture for Konstantinos Voudouris

Konstantinos Voudouris

UK AI Security Institute

Item Response Theory for AI Safety

Add code
Aug 05, 2026
Viaarxiv icon

Can AI agents conduct open-ended AI research? Early evidence from two case studies

Add code
Jul 29, 2026
Viaarxiv icon

Persona Cartography: Charting Language Model Personality Traits in Weight Space

Add code
Jul 08, 2026
Viaarxiv icon

In-Context Function Learning in Large Language Models

Add code
Feb 12, 2026
Viaarxiv icon

Can vision language models learn intuitive physics from interaction?

Add code
Feb 05, 2026
Viaarxiv icon

Exploring Major Transitions in the Evolution of Biological Cognition With Artificial Neural Networks

Add code
Sep 17, 2025
Figure 1 for Exploring Major Transitions in the Evolution of Biological Cognition With Artificial Neural Networks
Figure 2 for Exploring Major Transitions in the Evolution of Biological Cognition With Artificial Neural Networks
Figure 3 for Exploring Major Transitions in the Evolution of Biological Cognition With Artificial Neural Networks
Figure 4 for Exploring Major Transitions in the Evolution of Biological Cognition With Artificial Neural Networks
Viaarxiv icon

Cognitive Science-Inspired Evaluation of Core Capabilities for Object Understanding in AI

Add code
Mar 27, 2025
Figure 1 for Cognitive Science-Inspired Evaluation of Core Capabilities for Object Understanding in AI
Figure 2 for Cognitive Science-Inspired Evaluation of Core Capabilities for Object Understanding in AI
Viaarxiv icon

Bringing Comparative Cognition To Computers

Add code
Mar 04, 2025
Viaarxiv icon

Testing the limits of fine-tuning to improve reasoning in vision language models

Add code
Feb 21, 2025
Figure 1 for Testing the limits of fine-tuning to improve reasoning in vision language models
Figure 2 for Testing the limits of fine-tuning to improve reasoning in vision language models
Figure 3 for Testing the limits of fine-tuning to improve reasoning in vision language models
Figure 4 for Testing the limits of fine-tuning to improve reasoning in vision language models
Viaarxiv icon

PredictaBoard: Benchmarking LLM Score Predictability

Add code
Feb 20, 2025
Viaarxiv icon