NeurIPS 2025 Explorer
Concepts
Authors
Glossary
johnsanterre.github.io
distributional mismatch
3 papers
Improving Reward Models with Proximal Policy Exploration for Preference-Based Reinforcement Learning
Learning Preferences without Interaction for Cooperative AI: A Hybrid Offline-Online Approach
Leveraging robust optimization for llm alignment under distribution shifts