NeurIPS 2025 Explorer
Concepts
Authors
Glossary
johnsanterre.github.io
llama 3
3 papers
Causal Head Gating: A Framework for Interpreting Roles of Attention Heads in Transformers
Provable Gradient Editing of Deep Neural Networks
SWE-RL: Advancing LLM Reasoning via Reinforcement Learning on Open Software Evolution