Auto-encoding variational bayes
Original
Diederik P Kingma and Max Welling · 2013
Cited alongside, same era.
Generative adversarial nets
Ian Goodfellow, Jean Pouget-Abadie, Mehdi Mirza, Bing Xu, David Warde-Farley, Sherjil Ozair, Aaron Courville, and Yoshua Bengio · 2014
Cited alongside, same era.
Adam: A method for stochastic optimization
Original
Diederik P Kingma and Jimmy Ba · 2014
Cited alongside, same era.
Learning to predict phases of manipulation tasks as hidden states
O. Kroemer, H. van Hoof, G. Neumann, and J. Peters · 2014
Cited alongside, same era.
Nonparametric bayesian reward segmentation for skill discovery using inverse reinforcement learning
Pravesh Ranchod, Benjamin Rosman, and George Konidaris · 2015
Cited alongside, same era.
Openai gym, 2016
Greg Brockman, Vicki Cheung, Ludwig Pettersson, Jonas Schneider, John Schulman, Jie Tang, and Wojciech Zaremba · 2016
Cited alongside, same era.
Infogan: Interpretable representation learning by information maximizing generative adversarial nets
Xi Chen, Yan Duan, Rein Houthooft, John Schulman, Ilya Sutskever, and Pieter Abbeel · 2016
Cited alongside, same era.
Probabilistic inference for determining options in reinforcement learning
Christian Daniel, Herke Van Hoof, Jan Peters, and Gerhard Neumann · 2016
Cited alongside, same era.
Generative adversarial imitation learning
Jonathan Ho and Stefano Ermon · 2016
Cited alongside, same era.