Deep Reinforcement Learning Doesn't Work Yet

deep-rlcritiquesample-efficiencyreward-hacking

Abstraction: Systematic critique of deep RL limitations and failure modes

Key points:

Connections: Deepmind · Openai · Google Brain · Reinforcement Learning · Reward Function Design · Exploration Exploitation

Source: https://www.alexirpan.com/2018/02/14/rl-hard.html