Fetching the paper…
Reading the bibliography…
Reinforcement learning (RL) is a powerful tool for finding optimal policies in sequential decision processes.
Reasoning about infinite computation paths
Pierre Wolper, Moshe Y Vardi, and A Prasad Sistla · 1983
Earlier work this paper cites.
Convergence of stochastic iterative dynamic programming algorithms
Tommi Jaakkola, Michael Jordan, and Satinder Singh · 1993
Earlier work this paper cites.
Behavior transfer for value-function-based reinforcement learning
Matthew E Taylor and Peter Stone · 2005
Earlier work this paper cites.
Synthesis for ltl and ldl on finite traces
Giuseppe De Giacomo and Moshe Vardi · 2015
Earlier work this paper cites.
Autonomous cross-domain knowledge transfer in lifelong policy gradient reinforcement learning
Haitham Bou Ammar, Eric Eaton, José Marcio Luna, and Paul Ruvolo · 2015
Earlier work this paper cites.
Tom Schaul, John Quan, Ioannis Antonoglou, and David Silver · 2015
Earlier work this paper cites.
Continuous control with deep reinforcement learning
TP Lillicrap · 2015
Earlier work this paper cites.
Andrei A Rusu, Sergio Gomez Colmenarejo, Caglar Gulcehre, Guillaume Desjardins, James Kirkpatrick, Razvan Pascanu, Volodymyr Mnih, Koray Kavukcuoglu, and Raia Hadsell · 2015
Earlier work this paper cites.
Deep logic networks: Inserting and extracting knowledge from deep belief networks
Son N Tran and Artur S d’Avila Garcez · 2016
Earlier work this paper cites.
Dueling network architectures for deep reinforcement learning
Ziyu Wang, Tom Schaul, Matteo Hessel, Hado Hasselt, Marc Lanctot, and Nando Freitas · 2016
Cited alongside, same era.
Deep reinforcement learning with double q-learning
Hado Van Hasselt, Arthur Guez, and David Silver · 2016
Cited alongside, same era.
Shufang Zhu, Lucas M Tabajara, Jianwen Li, Geguang Pu, and Moshe Y Vardi · 2017
Cited alongside, same era.
DARLA: Improving zero-shot transfer in reinforcement learning
Irina Higgins, Arka Pal, Andrei Rusu, Loic Matthey, Christopher Burgess, Alexander Pritzel, Matthew Botvinick, Charles Blundell, and Alexander Lerchner · 2017
Cited alongside, same era.
Programmatically interpretable reinforcement learning
Abhinav Verma, Vijayaraghavan Murali, Rishabh Singh, Pushmeet Kohli, and Swarat Chaudhuri · 2018
Cited alongside, same era.
Ltl and beyond: Formal languages for reward function specification in reinforcement learning
Alberto Camacho, Rodrigo Toro Icarte, Toryn Q Klassen, Richard Anthony Valenzano, and Sheila A McIlraith · 2019
Later among the works it cites.
Neurosymbolic reinforcement learning with formally verified exploration
Greg Anderson, Abhinav Verma, Isil Dillig, and Swarat Chaudhuri · 2020
Later among the works it cites.
Transfer learning in deep reinforcement learning: A survey
Zhuangdi Zhu, Kaixiang Lin, and Jiayu Zhou · 2020
Later among the works it cites.
Curl: Contrastive unsupervised representations for reinforcement learning
Aravind Srinivas, Michael Laskin, and Pieter Abbeel · 2020
Later among the works it cites.
Deepsynth: Automata synthesis for automatic task segmentation in deep reinforcement learning
Mohammadhosein Hasanbeig, Natasha Yogananda Jeppu, Alessandro Abate, Tom Melham, and Daniel Kroening · 2021
alphaXiv searches the wider corpus for related work and actual follow-ups.
alphaXiv is searching for related work…
Scott Fujimoto, Herke Hoof, and David Meger · 2018
Cited alongside, same era.
Disentangling factors of variation with cycle-consistent variational auto-encoders
Ananya Harsh Jha, Saket Anand, Maneesh Singh, and VS Rao Veeravasarapu · 2018
Cited alongside, same era.
Non-markovian rewards expressed in ltl: Guiding search via reward shaping (extended version)
Alberto Camacho, Oscar Chen, Scott Sanner, and Sheila A McIlraith · 2018
Cited alongside, same era.
Synthesis of ltl formulas from natural language texts: State of the art and research directions
Andrea Brunello, Angelo Montanari, and Mark Reynolds · 2019
Cited alongside, same era.
Later among the works it cites.
Dynamic automaton-guided reward shaping for monte carlo tree search
Alvaro Velasquez, Brett Bissey, Lior Barak, Andre Beckus, Ismail Alkhouri, Daniel Melcer, and George Atia · 2021
Later among the works it cites.
Domain adaptation in reinforcement learning via latent unified state representation
Jinwei Xing, Takashi Nagata, Kexin Chen, Xinyun Zou, Emre Neftci, and Jeffrey L Krichmar · 2021
Later among the works it cites.
Hybrid deep reprel: Integrating relational planning and reinforcement learning for information fusion
Harsha Kokel, Nikhilesh Prabhakar, Balaraman Ravindran, Erik Blasch, Prasad Tadepalli, and Sriraam Natarajan · 2022
Later among the works it cites.
Reward machines: Exploiting reward function structure in reinforcement learning
Rodrigo Toro Icarte, Toryn Q Klassen, Richard Valenzano, and Sheila A McIlraith · 2022
Later among the works it cites.