NeurIPS 2025 Explorer
Concepts
Authors
Glossary
johnsanterre.github.io
llm alignment
4 papers
$Q\sharp$: Provably Optimal Distributional RL for LLM Post-Training
LLM Safety Alignment is Divergence Estimation in Disguise
Meta-Learning Objectives for Preference Optimization
What Matters in Data for DPO?