NeurIPS 2025 Explorer
Concepts
Authors
Glossary
johnsanterre.github.io
accuracy trade-off
4 papers
Efficient Large Language Model Inference with Neural Block Linearization
ParetoQ: Improving Scaling Laws in Extremely Low-bit LLM Quantization
SAFE: Multitask Failure Detection for Vision-Language-Action Models
What Really is a Member? Discrediting Membership Inference via Poisoning