NeurIPS 2025 Explorer
Concepts
Authors
Glossary
johnsanterre.github.io
Zhenxing Ge
3 papers
Nanjing University
Efficient Last-Iterate Convergence in Solving Extensive-Form Games
Improving Reward Models with Proximal Policy Exploration for Preference-Based Reinforcement Learning
Last-Iterate Convergence of Smooth Regret Matching$^+$ Variants in Learning Nash Equilibria