Picture for Anya Sims

Anya Sims

AI Research Preference Models

Add code
Aug 14, 2026
Viaarxiv icon

Training AI Scientists to Replicate Research

Add code
Aug 13, 2026
Viaarxiv icon

CODA: Coordination via On-Policy Diffusion for Multi-Agent Offline Reinforcement Learning

Add code
Apr 25, 2026
Viaarxiv icon

Reinforcing General Reasoning without Verifiers

Add code
May 27, 2025
Viaarxiv icon

The Edge-of-Reach Problem in Offline Model-Based Reinforcement Learning

Add code
Feb 19, 2024
Figure 1 for The Edge-of-Reach Problem in Offline Model-Based Reinforcement Learning
Figure 2 for The Edge-of-Reach Problem in Offline Model-Based Reinforcement Learning
Figure 3 for The Edge-of-Reach Problem in Offline Model-Based Reinforcement Learning
Figure 4 for The Edge-of-Reach Problem in Offline Model-Based Reinforcement Learning
Viaarxiv icon