NeurIPS 2025 Explorer
Concepts
Authors
Glossary
johnsanterre.github.io
preference model
4 papers
Doubly Robust Alignment for Large Language Models
KL Penalty Control via Perturbation for Direct Preference Optimization
Preference-Guided Diffusion for Multi-Objective Offline Optimization
Transferable Black-Box One-Shot Forging of Watermarks via Image Preference Models