Inverse reinforcement learning with pi 2
Mrinal Kalakrishnan, Evangelos Theodorou, and Stefan Schaal · 2010
Cited alongside, same era.
Relative entropy policy search
Jan Peters, Katharina Mülling, and Yasemin Altün · 2010
Cited alongside, same era.
A generalized path integral control approach to reinforcement learning
Evangelos Theodorou, Jonas Buchli, and Stefan Schaal · 2010
Cited alongside, same era.
Relative entropy inverse reinforcement learning
Abdeslam Boularias, Jens Kober, and Jan Peters · 2011
Cited alongside, same era.
Autonomous reinforcement learning on raw visual input data in a real world application
Sascha Lange, Martin Riedmiller, and Arne Voigtländer · 2012
Cited alongside, same era.
Modeling and planning high-level in-hand manipulation actions from human knowledge and active learning from demonstration
Urbain Prieur, Véronique Perdereau, and Alexandre Bernardino · 2012
Cited alongside, same era.
Scalable reward learning from demonstration
Bernard Michini, Mark Cutler, and Jonathan P How · 2013
Cited alongside, same era.
A user study on kinesthetic teaching of redundant robots in task and configuration space
Sebastian Wrede, Christian Emmerich, Ricarda Grünberg, Arne Nordmann, Agnes Swadzba, and Jochen Steil · 2013
Cited alongside, same era.
Efficient image and video co-localization with frank-wolfe algorithm
A. Joulin, K. Tang, and L. Fei-Fei · 2014
Cited alongside, same era.
Learning to predict phases of manipulation tasks as hidden states
Oliver Kroemer, Herke Van Hoof, Gerhard Neumann, and Jan Peters · 2014
Cited alongside, same era.
Swirl: A sequential windowed inverse reinforcement learning algorithm for robot tasks with delayed rewards
Cited in the paper.
A connection between generative adversarial networks, inverse reinforcement learning, and energy-based models
Original
Chelsea Finn, Paul Christiano, Pieter Abbeel, and Sergey Levine
Cited in the paper.