Transfer from simulation to real world through learning deep inverse dynamics model
Original
Paul Christiano, Zain Shah, Igor Mordatch, Jonas Schneider, Trevor Blackwell, Joshua Tobin, Pieter Abbeel, and Wojciech Zaremba · 2016
Cited alongside, same era.
Deep learning for reward design to improve monte carlo tree search in atari games
Original
Xiaoxiao Guo, Satinder Singh, Richard Lewis, and Honglak Lee · 2016
Cited alongside, same era.
Deep learning of robotic tasks using strong and weak human supervision
Original
Bar Hilleli and Ran El-Yaniv · 2016
Cited alongside, same era.
Generative adversarial imitation learning
Jonathan Ho and Stefano Ermon · 2016
Cited alongside, same era.
Active reinforcement learning: Observing rewards at a cost
David Krueger, Jan Leike, Owain Evans, and John Salvatier · 2016
Cited alongside, same era.
Combating deep reinforcement learning’s sisyphean curse with reinforcement learning
Original
Zachary C Lipton, Abhishek Kumar, Jianfeng Gao, Lihong Li, and Li Deng · 2016
Cited alongside, same era.
Asynchronous methods for deep reinforcement learning
Volodymyr Mnih, Adria Puigdomenech Badia, Mehdi Mirza, Alex Graves, Timothy Lillicrap, Tim Harley, David Silver, and Koray Kavukcuoglu · 2016
Cited alongside, same era.
Learning values across many orders of magnitude
Hado van Hasselt, Arthur Guez, Matteo Hessel, Volodymyr Mnih, and David Silver · 2016
Cited alongside, same era.
Deep reinforcement learning with double q-learning
Hado Van Hasselt, Arthur Guez, and David Silver · 2016
Cited alongside, same era.
Human-level control through deep reinforcement learning
Volodymyr Mnih, Koray Kavukcuoglu, David Silver, Andrei A. Rusu, Joel Veness, Marc G. Bellemare, Alex Graves, Martin Riedmiller, Andreas K. Fidjeland, Georg Ostrovski, Stig Petersen, Charles Beattie, Amir Sadik, Ioannis Antonoglou, Helen King, Dharshan Kumaran, Daan Wierstra, Shane Legg, and Demis Hassabis
Cited in the paper.
Human-level control through deep reinforcement learning
Volodymyr Mnih, Koray Kavukcuoglu, David Silver, Andrei A Rusu, Joel Veness, Marc G Bellemare, Alex Graves, Martin Riedmiller, Andreas K Fidjeland, Georg Ostrovski, et al
Cited in the paper.