NeurIPS 2025 Explorer
Concepts
Authors
Glossary
johnsanterre.github.io
state-of-the-art llms
3 papers
Benchmarking Large Language Models with Integer Sequence Generation Tasks
Dynamics of Spontaneous Topic Changes in Next Token Prediction with Self-Attention
EffiBench-X: A Multi-Language Benchmark for Measuring Efficiency of LLM-Generated Code