NeurIPS 2025 Explorer
Concepts
Authors
Glossary
johnsanterre.github.io
algorithm scalability
3 papers
Beyond Verifiable Rewards: Scaling Reinforcement Learning in Language Models to Unverifiable Data
KOALA++: Efficient Kalman-Based Optimization with Gradient-Covariance Products
Principled Model Routing for Unknown Mixtures of Source Domains