NeurIPS 2025 Explorer
Concepts
Authors
Glossary
johnsanterre.github.io
data poisoning
3 papers
BackdoorLLM: A Comprehensive Benchmark for Backdoor Attacks and Defenses on Large Language Models
Provable Watermarking for Data Poisoning Attacks
ToxicTextCLIP: Text-Based Poisoning and Backdoor Attacks on CLIP Pre-training