NeurIPS 2025 Explorer
Concepts
Authors
Glossary
johnsanterre.github.io
Yang Xu
3 papers
Nanjing University
Federated Multi-armed Bandits with Efficient Bit-Level Communications
Finite-Sample Analysis of Policy Evaluation for Robust Average Reward Reinforcement Learning
Global Convergence for Average Reward Constrained MDPs with Primal-Dual Actor Critic Algorithm