Novelty or Surprise?
Andrew Barto, Marco Mirolli, and Gianluca Baldassarre · 2013
Cited alongside, same era.
PAC Optimal Exploration in Continuous Space Markov Decision Processes
Jason Pazis and Ronald Parr · 2013
Cited alongside, same era.
Human-level control through deep reinforcement learning
Volodymyr Mnih, Koray Kavukcuoglu, David Silver, Andrei a Rusu, Joel Veness, Marc G Bellemare, Alex Graves, Martin Riedmiller, Andreas K Fidjeland, Georg Ostrovski, Stig Petersen, Charles Beattie, Amir Sadik, Ioannis Antonoglou, Helen King, Dharshan Kumaran, Daan Wierstra, Shane Legg, and Demis Hassabis · 2015
Cited alongside, same era.
Variational Information Maximisation for Intrinsically Motivated Reinforcement Learning
Shakir Mohamed and Danilo J Rezende · 2015
Cited alongside, same era.
Massively Parallel Methods for Deep Reinforcement Learning
Arun Nair, Praveen Srinivasan, Sam Blackwell, Cagdas Alcicek, Rory Fearon, Alessandro De Maria, Mustafa Suleyman, Charles Beattie, Stig Petersen, Shane Legg, Volodymyr Mnih, and David Silver · 2015
Cited alongside, same era.
Action-Conditional Video Prediction using Deep Networks in Atari Games
Junhyuk Oh, Guo Xiaoxiao, Lee Honglak, Lewis Richard, and Singh Satinder · 2015
Cited alongside, same era.
Trust Region Policy Optimization
John Schulman, Philipp Moritz, Michael Jordan, and Pieter Abbeel · 2015
Cited alongside, same era.
Incentivizing Exploration In Reinforcement Learning With Deep Predictive Models
Bradly C. Stadie, Sergey Levine, and Pieter Abbeel · 2015
Cited alongside, same era.
Unifying Count-Based Exploration and Intrinsic Motivation
Marc G Bellemare, Sriram Srinivasan, Georg Ostrovski, Tom Schaul, David Saxton, Google Deepmind, and Rémi Munos · 2016
Cited alongside, same era.