NeurIPS 2025 Explorer
Concepts
Authors
Glossary
johnsanterre.github.io
Zican Hu
3 papers
Nanjing University
Learning to Reason under Off-Policy Guidance
Mixture-of-Experts Meets In-Context Reinforcement Learning
Text-to-Decision Agent: Offline Meta-Reinforcement Learning from Natural Language Supervision