inverse reinforcement learning
- Estimating cognitive biases with attention-aware inverse planning
- Inverse Optimization Latent Variable Models for Learning Costs Applied to Route Problems
- Ranking-based Preference Optimization for Diffusion Models from Implicit User Feedback
- Trajectory Graph Learning: Aligning with Long Trajectories in Reinforcement Learning Without Reward Design
- Trust Region Reward Optimization and Proximal Inverse Reward Optimization Algorithm