“Continuous control with deep reinforcement learning”
Timothy Lillicrap et al · 2016
Cited alongside, same era.
“Reproducibility of benchmarked deep reinforcement learning tasks for continuous control”
Original
Riashat Islam, Peter Henderson, Maziar Gomrokchi and Doina Precup · 2017
Cited alongside, same era.
“Time limits in reinforcement learning”
Original
Fabio Pardo, Arash Tavakoli, Vitaly Levdik and Petar Kormushev · 2017
Cited alongside, same era.
“Proximal policy optimization algorithms”
Original
John Schulman et al · 2017
Cited alongside, same era.
“Maximum a posteriori policy optimisation”
Original
Abbas Abdolmaleki et al · 2018
Cited alongside, same era.
“IMPALA: Scalable Distributed Deep-RL with Importance Weighted Actor-Learner Architectures”
Lasse Espeholt et al · 2018
Cited alongside, same era.
“Soft actor-critic algorithms and applications”
Original
Tuomas Haarnoja et al · 2018
Cited alongside, same era.
“Soft Actor-Critic: Off-Policy Maximum Entropy Deep Reinforcement Learning with a Stochastic Actor”
Tuomas Haarnoja, Aurick Zhou, Pieter Abbeel and Sergey Levine · 2018
Cited alongside, same era.
“Deep reinforcement learning that matters”
Peter Henderson et al · 2018
Cited alongside, same era.
“Challenging common assumptions in the unsupervised learning of disentangled representations”
Original
Francesco Locatello et al · 2018
Cited alongside, same era.
“Are gans created equal? a large-scale study”
Mario Lucic et al · 2018
Cited alongside, same era.
“Learning dexterous in-hand manipulation”
Original
M OpenAI et al · 2018
Cited alongside, same era.