NeurIPS 2025 Explorer
Concepts
Authors
Glossary
johnsanterre.github.io
reward distribution
3 papers
Imitation Beyond Expectation Using Pluralistic Stochastic Dominance
Risk-Averse Constrained Reinforcement Learning with Optimized Certainty Equivalents
Vinci: Deep Thinking in Text-to-Image Generation using Unified Model with Reinforcement Learning