Picture for Erick Delage

Erick Delage

Online Policy Evaluation for MDPs with Dynamic UBSR Measures

Add code
Jul 25, 2026
Viaarxiv icon

Epistemic Robust Offline Reinforcement Learning

Add code
Apr 08, 2026
Viaarxiv icon

Reward Redistribution for CVaR MDPs using a Bellman Operator on L-infinity

Add code
Feb 03, 2026
Viaarxiv icon

Boosting CVaR Policy Optimization with Quantile Gradients

Add code
Jan 29, 2026
Viaarxiv icon

Navigating Demand Uncertainty in Container Shipping: Deep Reinforcement Learning for Enabling Adaptive and Feasible Master Stowage Planning

Add code
Feb 19, 2025
Figure 1 for Navigating Demand Uncertainty in Container Shipping: Deep Reinforcement Learning for Enabling Adaptive and Feasible Master Stowage Planning
Figure 2 for Navigating Demand Uncertainty in Container Shipping: Deep Reinforcement Learning for Enabling Adaptive and Feasible Master Stowage Planning
Figure 3 for Navigating Demand Uncertainty in Container Shipping: Deep Reinforcement Learning for Enabling Adaptive and Feasible Master Stowage Planning
Figure 4 for Navigating Demand Uncertainty in Container Shipping: Deep Reinforcement Learning for Enabling Adaptive and Feasible Master Stowage Planning
Viaarxiv icon

Fair Resource Allocation in Weakly Coupled Markov Decision Processes

Add code
Nov 14, 2024
Figure 1 for Fair Resource Allocation in Weakly Coupled Markov Decision Processes
Figure 2 for Fair Resource Allocation in Weakly Coupled Markov Decision Processes
Figure 3 for Fair Resource Allocation in Weakly Coupled Markov Decision Processes
Figure 4 for Fair Resource Allocation in Weakly Coupled Markov Decision Processes
Viaarxiv icon

Q-learning for Quantile MDPs: A Decomposition, Performance, and Convergence Analysis

Add code
Oct 31, 2024
Figure 1 for Q-learning for Quantile MDPs: A Decomposition, Performance, and Convergence Analysis
Figure 2 for Q-learning for Quantile MDPs: A Decomposition, Performance, and Convergence Analysis
Figure 3 for Q-learning for Quantile MDPs: A Decomposition, Performance, and Convergence Analysis
Figure 4 for Q-learning for Quantile MDPs: A Decomposition, Performance, and Convergence Analysis
Viaarxiv icon

Planning and Learning in Risk-Aware Restless Multi-Arm Bandit Problem

Add code
Oct 30, 2024
Viaarxiv icon

Data-driven decision-making under uncertainty with entropic risk measure

Add code
Sep 30, 2024
Figure 1 for Data-driven decision-making under uncertainty with entropic risk measure
Figure 2 for Data-driven decision-making under uncertainty with entropic risk measure
Figure 3 for Data-driven decision-making under uncertainty with entropic risk measure
Figure 4 for Data-driven decision-making under uncertainty with entropic risk measure
Viaarxiv icon

End-to-end Conditional Robust Optimization

Add code
Mar 07, 2024
Figure 1 for End-to-end Conditional Robust Optimization
Figure 2 for End-to-end Conditional Robust Optimization
Figure 3 for End-to-end Conditional Robust Optimization
Figure 4 for End-to-end Conditional Robust Optimization
Viaarxiv icon