Picture for Marco Mussi

Marco Mussi

Generalizing Preference-based Reinforcement Learning: a Rationality Model for Incomparability

Add code
Jul 13, 2026
Viaarxiv icon

Learning Deterministic Policies with Policy Gradients in Constrained Markov Decision Processes

Add code
Jun 06, 2025
Figure 1 for Learning Deterministic Policies with Policy Gradients in Constrained Markov Decision Processes
Figure 2 for Learning Deterministic Policies with Policy Gradients in Constrained Markov Decision Processes
Figure 3 for Learning Deterministic Policies with Policy Gradients in Constrained Markov Decision Processes
Figure 4 for Learning Deterministic Policies with Policy Gradients in Constrained Markov Decision Processes
Viaarxiv icon

Reusing Trajectories in Policy Gradients Enables Fast Convergence

Add code
Jun 06, 2025
Figure 1 for Reusing Trajectories in Policy Gradients Enables Fast Convergence
Figure 2 for Reusing Trajectories in Policy Gradients Enables Fast Convergence
Figure 3 for Reusing Trajectories in Policy Gradients Enables Fast Convergence
Figure 4 for Reusing Trajectories in Policy Gradients Enables Fast Convergence
Viaarxiv icon

A Refined Analysis of UCBVI

Add code
Feb 24, 2025
Viaarxiv icon

Bridging Rested and Restless Bandits with Graph-Triggering: Rising and Rotting

Add code
Sep 09, 2024
Figure 1 for Bridging Rested and Restless Bandits with Graph-Triggering: Rising and Rotting
Figure 2 for Bridging Rested and Restless Bandits with Graph-Triggering: Rising and Rotting
Viaarxiv icon

State and Action Factorization in Power Grids

Add code
Sep 03, 2024
Figure 1 for State and Action Factorization in Power Grids
Figure 2 for State and Action Factorization in Power Grids
Viaarxiv icon

Last-Iterate Global Convergence of Policy Gradients for Constrained Reinforcement Learning

Add code
Jul 15, 2024
Viaarxiv icon

Open Problem: Tight Bounds for Kernelized Multi-Armed Bandits with Bernoulli Rewards

Add code
Jul 08, 2024
Viaarxiv icon

Learning Optimal Deterministic Policies with Stochastic Policy Gradients

Add code
May 03, 2024
Figure 1 for Learning Optimal Deterministic Policies with Stochastic Policy Gradients
Figure 2 for Learning Optimal Deterministic Policies with Stochastic Policy Gradients
Figure 3 for Learning Optimal Deterministic Policies with Stochastic Policy Gradients
Figure 4 for Learning Optimal Deterministic Policies with Stochastic Policy Gradients
Viaarxiv icon

Best Arm Identification for Stochastic Rising Bandits

Add code
Feb 15, 2023
Viaarxiv icon