NeurIPS 2025 Explorer
Concepts
Authors
Glossary
johnsanterre.github.io
symbolic verification
3 papers
Diagnosing and Addressing Pitfalls in KG-RAG Datasets: Toward More Reliable Benchmarking
OMEGA: Can LLMs Reason Outside the Box in Math? Evaluating Exploratory, Compositional, and Transformative Generalization
Towards Reliable Code-as-Policies: A Neuro-Symbolic Framework for Embodied Task Planning