NeurIPS 2025 Explorer
Concepts
Authors
Glossary
johnsanterre.github.io
Xiao Zhou
3 papers
Tsinghua University, Tsinghua University
Counterfactual Reasoning for Steerable Pluralistic Value Alignment of Large Language Models
Efficient Utility-Preserving Machine Unlearning with Implicit Gradient Surgery
Think or Not? Exploring Thinking Efficiency in Large Reasoning Models via an Information-Theoretic Lens