reasoning strategies
- Aux-Think: Exploring Reasoning Strategies for Data-Efficient Vision-Language Navigation
- Creativity or Brute Force? Using Brainteasers as a Window into the Problem-Solving Abilities of Large Language Models
- KORGym: A Dynamic Game Platform for LLM Reasoning Evaluation
- ProRL: Prolonged Reinforcement Learning Expands Reasoning Boundaries in Large Language Models
- Rethinking Fine-Tuning when Scaling Test-Time Compute: Limiting Confidence Improves Mathematical Reasoning
- SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation