Haipeng Luo
- Adapting to Stochastic and Adversarial Losses in Episodic MDPs with Aggregate Bandit Feedback
- Comparator-Adaptive $\Phi$-Regret: Improved Bounds, Simpler Algorithms, and Applications to Games
- From Average-Iterate to Last-Iterate Convergence in Games: A Reduction and Its Applications
- Improved Bounds for Swap Multicalibration and Swap Omniprediction
- Improved Regret and Contextual Linear Extension for Pandora's Box and Prophet Inequality
- Simultaneous Swap Regret Minimization via KL-Calibration