NeurIPS 2025 Explorer
Concepts
Authors
Glossary
johnsanterre.github.io
Jiaying Wu
3 papers
National University of Singapore
ConfTuner: Training Large Language Models to Express Their Confidence Verbally
MLR-Bench: Evaluating AI Agents on Open-Ended Machine Learning Research
Truth over Tricks: Measuring and Mitigating Shortcut Learning in Misinformation Detection