Hierarchical deep reinforcement learning: Integrating temporal abstraction and intrinsic motivation
T. D. Kulkarni, K. Narasimhan, A. Saeedi, and J. Tenenbaum · 2016
Cited alongside, same era.
The option-critic architecture
Original
P. Bacon, J. Harb, and D. Precup · 2016
Cited alongside, same era.
Policy distillation
A. A. Rusu, S. G. Colmenarejo, Ç. Gülçehre, G. Desjardins, J. Kirkpatrick, R. Pascanu, V. Mnih, K. Kavukcuoglu, and R. Hadsell · 2016
Cited alongside, same era.
Deep reinforcement learning for robotic manipulation with asynchronous off-policy updates
S. Gu, E. Holly, T. P. Lillicrap, and S. Levine · 2017
Cited alongside, same era.
Multi-level discovery of deep options
Original
R. Fox, S. Krishnan, I. Stoica, and K. Goldberg · 2017
Cited alongside, same era.
Feudal networks for hierarchical reinforcement learning
Original
A. S. Vezhnevets, S. Osindero, T. Schaul, N. Heess, M. Jaderberg, D. Silver, and K. Kavukcuoglu · 2017
Cited alongside, same era.
Hierarchical actor-critic
Original
A. Levy, R. P. Jr., and K. Saenko · 2017
Cited alongside, same era.
Hindsight experience replay
Original
M. Andrychowicz, F. Wolski, A. Ray, J. Schneider, R. Fong, P. Welinder, B. McGrew, J. Tobin, P. Abbeel, and W. Zaremba · 2017
Cited alongside, same era.
Multi-modal imitation learning from unstructured demonstrations using generative adversarial nets
K. Hausman, Y. Chebotar, S. Schaal, G. S. Sukhatme, and J. J. Lim · 2017
Cited alongside, same era.
Divide-and-conquer reinforcement learning
Original
D. Ghosh, A. Singh, A. Rajeswaran, V. Kumar, and S. Levine · 2017
Cited alongside, same era.
Diversity is all you need: Learning skills without a reward function
Original
B. Eysenbach, A. Gupta, J. Ibarz, and S. Levine · 2018
Cited alongside, same era.
Qt-opt: Scalable deep reinforcement learning for vision-based robotic manipulation
D. Kalashnikov, A. Irpan, P. Pastor, J. Ibarz, A. Herzog, E. Jang, D. Quillen, E. Holly, M. Kalakrishnan, V. Vanhoucke, and S. Levine
Cited in the paper.