Meta-Q-Learning

meta-reinforcement-learningq-learningoff-policycontinuous-control

Abstraction: Off-policy meta-RL via Q-learning with trajectory context variable

Key points:

Connections: Meta Reinforcement Learning · Q Learning · Off Policy Learning

Source: https://iclr.cc/virtual_2020/poster_SJeD3CEFPH.html