NeurIPS 2025 Explorer
Concepts
Authors
Glossary
johnsanterre.github.io
logits
4 papers
Flexible Realignment of Language Models
KL Penalty Control via Perturbation for Direct Preference Optimization
Neural Collapse in Cumulative Link Models for Ordinal Regression: An Analysis with Unconstrained Feature Model
ShiQ: Bringing back Bellman to LLMs