NeurIPS 2025 Explorer
Concepts
Authors
Glossary
johnsanterre.github.io
off-policy
3 papers
Conformal Prediction Beyond the Horizon: Distribution-Free Inference for Policy Evaluation
Continuous Soft Actor-Critic: An Off-Policy Learning Method Robust to Time Discretization
Uni-RL: Unifying Online and Offline RL via Implicit Value Regularization