Learning values across many orders of magnitude
Hado P van Hasselt, Arthur Guez, Matteo Hessel, Volodymyr Mnih, and David Silver · 2016
Cited alongside, same era.
Reinforcement learning Coach
Itai Caspi, Gal Leibovich, Gal Novik, and Shadi Endrawis · 2017
Cited alongside, same era.
Efficient parallel methods for deep reinforcement learning
Original
Alfredo V Clemente, Humberto N Castejón, and Arjun Chandra · 2017
Cited alongside, same era.
Tensorforce: a tensorflow library for applied reinforcement learning
Alexander Kuhnle, Michael Schaarschmidt, and Kai Fricke · 2017
Cited alongside, same era.
Curiosity-driven exploration by self-supervised prediction
Deepak Pathak, Pulkit Agrawal, Alexei A Efros, and Trevor Darrell · 2017
Cited alongside, same era.
Mastering the game of go without human knowledge
David Silver, Julian Schrittwieser, Karen Simonyan, Ioannis Antonoglou, Aja Huang, Arthur Guez, Thomas Hubert, Lucas Baker, Matthew Lai, Adrian Bolton, et al · 2017
Cited alongside, same era.
RLlib: Abstractions for distributed reinforcement learning
Eric Liang, Richard Liaw, Robert Nishihara, Philipp Moritz, Roy Fox, Ken Goldberg, Joseph Gonzalez, Michael I. Jordan, and Ion Stoica · 2018
Cited alongside, same era.