NeurIPS 2025 Explorer
Concepts
Authors
Glossary
johnsanterre.github.io
reasoning processes
3 papers
Beyond Accuracy: Dissecting Mathematical Reasoning for LLMs Under Reinforcement Learning
MMaDA: Multimodal Large Diffusion Language Models
SAM-R1: Leveraging SAM for Reward Feedback in Multimodal Segmentation via Reinforcement Learning