NeurIPS 2025 Explorer
Concepts
Authors
Glossary
johnsanterre.github.io
math
3 papers
Belief-Calibrated Multi-Agent Consensus Seeking for Complex NLP Tasks
CPPO: Accelerating the Training of Group Relative Policy Optimization-Based Reasoning Models
Inference-time Alignment in Continuous Space