answer generation
- AceSearcher: Bootstrapping Reasoning and Search for LLMs via Reinforced Self-Play
- Improving Retrieval-Augmented Generation through Multi-Agent Reinforcement Learning
- Incentivizing LLMs to Self-Verify Their Answers
- Search and Refine During Think: Facilitating Knowledge Refinement for Improved Retrieval-Augmented Reasoning