Picture for Martha White

Martha White

Dynamics Models for Offline Hyperparameter Selection in Real-World RL

Add code
Aug 11, 2026
Viaarxiv icon

Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning

Add code
Jul 27, 2026
Viaarxiv icon

Deconstructing Actor-Critic: A Large-scale Empirical Study of Design Components for Practitioners

Add code
Jul 14, 2026
Viaarxiv icon

Accelerating Q-learning through Efficient Value-Sharing across Actions

Add code
Jun 29, 2026
Viaarxiv icon

Position: RL Researchers Need to Distinguish Between Solving Simulators and Using Simulators as a Proxy

Add code
Jun 26, 2026
Viaarxiv icon

Measure-to-measure Regression with Transformers

Add code
May 27, 2026
Viaarxiv icon

Addressing Terminal Constraints in Data-Driven Demand Response Scheduling

Add code
May 14, 2026
Viaarxiv icon

Revisiting Mixture Policies in Entropy-Regularized Actor-Critic

Add code
May 09, 2026
Viaarxiv icon

Regularized Latent Dynamics Prediction is a Strong Baseline For Behavioral Foundation Models

Add code
Mar 16, 2026
Viaarxiv icon

Gradient Iterated Temporal-Difference Learning

Add code
Mar 08, 2026
Viaarxiv icon