Bo An
- Deciphering the Extremes: A Novel Approach for Pathological Long-tailed Recognition in Scientific Discovery
- EconGym: A Scalable AI Testbed with Diverse Economic Tasks
- Efficient Last-Iterate Convergence in Solving Extensive-Form Games
- Empirical Study on Robustness and Resilience in Cooperative Multi-Agent Reinforcement Learning
- Establishing Linear Surrogate Regret Bounds for Convex Smooth Losses via Convolutional Fenchel–Young Losses
- Group-in-Group Policy Optimization for LLM Agent Training
- Improving Reward Models with Proximal Policy Exploration for Preference-Based Reinforcement Learning
- Incentivizing LLMs to Self-Verify Their Answers
- Let's Revise Step-by-Step: A Unified Local Search Framework for Code Generation with LLMs
- MF-LLM: Simulating Population Decision Dynamics via a Mean-Field Large Language Model Framework
- OPHR: Mastering Volatility Trading with Multi-Agent Deep Reinforcement Learning