Generative adversarial nets
Goodfellow, Ian, Pouget-Abadie, Jean, Mirza, Mehdi, Xu, Bing, Warde-Farley, David, Ozair, Sherjil, Courville, Aaron, and Bengio, Yoshua · 2014
Cited alongside, same era.
Guided cost learning: Deep inverse optimal control via policy optimization
Finn, Chelsea, Levine, Sergey, and Abbeel, Pieter · 2016
Cited alongside, same era.
Generative adversarial imitation learning
Ho, Jonathan and Ermon, Stefano · 2016
Cited alongside, same era.
Repeated inverse reinforcement learning
Amin, Kareem, Jiang, Nan, and Singh, Satinder · 2017
Cited alongside, same era.
An alternative softmax operator for reinforcement learning
Asadi, Kavosh and Littman, Michael L · 2017
Cited alongside, same era.
One-shot imitation learning
Duan, Yan, Andrychowicz, Marcin, Stadie, Bradly, Ho, Jonathan, Schneider, Jonas, Sutskever, Ilya, Abbeel, Pieter, and Zaremba, Wojciech · 2017
Cited alongside, same era.
Model-agnostic meta-learning for fast adaptation of deep networks
Finn, Chelsea, Abbeel, Pieter, and Levine, Sergey · 2017
Cited alongside, same era.
Multi-modal imitation learning from unstructured demonstrations using generative adversarial nets
Hausman, Karol, Chebotar, Yevgen, Schaal, Stefan, Sukhatme, Gaurav, and Lim, Joseph J · 2017
Cited alongside, same era.