NeurIPS 2025 Explorer
Concepts
Authors
Glossary
johnsanterre.github.io
reinforcement learning with verifiable rewards
3 papers
Enigmata: Scaling Logical Reasoning in Large Language Models with Synthetic Verifiable Puzzles
Learning to Reason under Off-Policy Guidance
Trust, But Verify: A Self-Verification Approach to Reinforcement Learning with Verifiable Rewards