llm reasoning
- Act Only When It Pays: Efficient Reinforcement Learning for LLM Reasoning via Selective Rollouts
- HumanoidGen: Data Generation for Bimanual Dexterous Manipulation via LLM Reasoning
- SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation
- SeePhys: Does Seeing Help Thinking? – Benchmarking Vision-Based Physics Reasoning