Picture for Dylan Bates

Dylan Bates

Can Editing 1 Neuron Fix Repetition Loops in LLMs?

Add code
Jun 09, 2026
Viaarxiv icon

EDGE-OPD: Internalizing Privileged Context with Evidence Guided On-Policy Distillation

Add code
May 22, 2026
Viaarxiv icon

EdgeRunner 20B: Military Task Parity with GPT-5 while Running on the Edge

Add code
Oct 30, 2025
Viaarxiv icon

A Hybrid Approach for Reinforcement Learning Using Virtual Policy Gradient for Balancing an Inverted Pendulum

Add code
Feb 06, 2021
Figure 1 for A Hybrid Approach for Reinforcement Learning Using Virtual Policy Gradient for Balancing an Inverted Pendulum
Figure 2 for A Hybrid Approach for Reinforcement Learning Using Virtual Policy Gradient for Balancing an Inverted Pendulum
Figure 3 for A Hybrid Approach for Reinforcement Learning Using Virtual Policy Gradient for Balancing an Inverted Pendulum
Figure 4 for A Hybrid Approach for Reinforcement Learning Using Virtual Policy Gradient for Balancing an Inverted Pendulum
Viaarxiv icon

Recommending More Efficient Workflows to Software Developers

Add code
Feb 06, 2021
Viaarxiv icon