Fetching the paper…
Reading the bibliography…
From a young age humans learn to use grammatical principles to hierarchically combine words into sentences.
Identifying hierarchical structure in sequences: A linear-time algorithm
C. Nevill-Manning and I. Witten · 1997
Earlier work this paper cites.
Rule-based and word-level statistics-based processing of language: Insights from neuroscience
N. Ding, L. Melloni, X. Tian, and D. Poeppel · 2012
Earlier work this paper cites.
The minimalist grammar of action
K. Pastra and Y. Aloimonos · 2012
Earlier work this paper cites.
Human-level control through deep reinforcement learning
Volodymyr Mnih, Koray Kavukcuoglu, David Silver, Andrei A. Rusu, Joel Veness, Marc G. Bellemare, Alex Graves, Martin A. Riedmiller, Andreas Fidjeland, Georg Ostrovski, Stig Petersen, Charles Beattie, Amir Sadik, Ioannis Antonoglou, Helen King, Dharshan Kumaran, Daan Wierstra, Shane Legg, and Demis Hassabis · 2015
Earlier work this paper cites.
Deep reinforcement learning with double q-learning
Hado van Hasselt, Arthur Guez, and David Silver · 2015
Earlier work this paper cites.
The Study of Language
G. Yule · 2015
Earlier work this paper cites.
Towards deep symbolic reinforcement learning
Marta Garnelo, Kai Arulkumaran, and Murray Shanahan · 2016
Earlier work this paper cites.
Strategic attentive writer for learning macro-actions
Alexander Vezhnevets, Volodymyr Mnih, John Agapiou, Simon Osindero, Alex Graves, Oriol Vinyals, and Koray Kavukcuoglu · 2016
Cited alongside, same era.
Learning to repeat: Fine grained action repetition for deep reinforcement learning
Sahil Sharma, Aravind S. Lakshminarayanan, and Balaraman Ravindran · 2017
Cited alongside, same era.
Mastering the game of go without human knowledge
David Silver, Julian Schrittwieser, Karen Simonyan, Ioannis Antonoglou, Aja Huang, Arthur Guez, Thomas Hubert, Lynette R. Baker, Matthew Lai, Adrian Bolton, Yutian Chen, Timothy P. Lillicrap, Hui-zhen Fan, Laurent Sifre, George van den Driessche, Thore Graepel, and Demis Hassabis · 2017
Cited alongside, same era.
Scalable trust-region method for deep reinforcement learning using kronecker-factored approximation
Yuhuai Wu, Elman Mansimov, Shun Liao, Roger B. Grosse, and Jimmy Ba · 2017
Cited alongside, same era.
Grammars of action in human behavior and evolution
Dietrich Stout, Thierry Chaminade, Andreas A. C. Thomik, Jan Apel, and Aldo A. Faisal · 2018
Later among the works it cites.
Relational deep reinforcement learning
Vinicius Zambaldi, David Raposo, Adam Santoro, Victor Bapst, Yujia Li, Igor Babuschkin, Karl Tuyls, David Reichert, Timothy Lillicrap, Edward Lockhart, et al · 2018
Later among the works it cites.
Dot-to-dot: Explainable hierarchical reinforcement learning for robotic manipulation
Benjamin Beyret, Ali Shafti, and A Aldo Faisal · 2019
Closest in time.
Reconciling deep learning with symbolic artificial intelligence: representing objects and relations
Marta Garnelo and Murray Shanahan · 2019
Closest in time.
Model-based reinforcement learning for atari
Lukasz Kaiser, Mohammad Babaeizadeh, Piotr Milos, Blazej Osinski, Roy H. Campbell, Konrad Czechowski, Dumitru Erhan, Chelsea Finn, Piotr Kozakowski, Sergey Levine, Ryan Sepassi, George Tucker, and Henryk Michalewski · 2019
alphaXiv searches the wider corpus for related work and actual follow-ups.
alphaXiv is searching for related work…
Tuomas Haarnoja, Aurick Zhou, Kristian Hartikainen, George Tucker, Sehoon Ha, Jie Tan, Vikash Kumar, Henry Zhu, Abhishek Gupta, Pieter Abbeel, and Sergey Levine · 2018
Cited alongside, same era.
Learning dexterous in-hand manipulation
OpenAI, Marcin Andrychowicz, Bowen Baker, Maciek Chociej, Rafal Józefowicz, Bob McGrew, Jakub W. Pachocki, Arthur Petron, Matthias Plappert, Glenn Powell, Alex Ray, Jonas Schneider, Szymon Sidor, Josh Tobin, Peter Welinder, Lilian Weng, and Wojciech Zaremba · 2018
Cited alongside, same era.
Closest in time.
Hierarchical reinforcement learning via advantage-weighted information maximization
T. Osa, V. Tangkaratt, and M. Sugiyama · 2019
Closest in time.