state transitions
- DEAL: Diffusion Evolution Adversarial Learning for Sim-to-Real Transfer
- DMWM: Dual-Mind World Model with Long-Term Imagination
- Language Models can Self-Improve at State-Value Estimation for Better Search
- RLVR-World: Training World Models with Reinforcement Learning
- Value-Guided Decision Transformer: A Unified Reinforcement Learning Framework for Online and Offline Settings