NeurIPS 2025 Explorer
Concepts
Authors
Glossary
johnsanterre.github.io
average-reward
3 papers
Offline Actor-Critic for Average Reward MDPs
Regret Analysis of Average-Reward Unichain MDPs via an Actor-Critic Approach
Sample Complexity of Distributionally Robust Average-Reward Reinforcement Learning