Picture for Joseph Lazzaro

Joseph Lazzaro

Non-Asymptotic Best Policy Identification Guarantees in Online Reinforcement Learning

Add code
Jul 19, 2026
Viaarxiv icon

A Finite Time Analysis of Thompson Sampling for Bayesian Optimization with Preferential Feedback

Add code
Apr 27, 2026
Viaarxiv icon