NeurIPS 2025 Explorer
Concepts
Authors
Glossary
johnsanterre.github.io
Kishan Panaganti
3 papers
Tencent AI Lab
Efficient Policy Optimization in Robust Constrained MDPs with Iteration Complexity Guarantees
Risk-Averse Total-Reward Reinforcement Learning
Robust LLM Alignment via Distributionally Robust Direct Preference Optimization