Fetching the paper…
Reading the bibliography…
Significant advances have recently been achieved in Multi-Agent Reinforcement Learning (MARL) which tackles sequential decision-making problems involving multiple participants.
Stochastic games
Lloyd S Shapley · 1953
Earlier work this paper cites.
Reinforcement learning - an introduction
Richard S. Sutton and Andrew G. Barto · 1998
Earlier work this paper cites.
A near-optimal polynomial time algorithm for learning in certain classes of stochastic games
Ronen I. Brafman and Moshe Tennenholtz · 2000
Earlier work this paper cites.
R-MAX - A general polynomial time algorithm for near-optimal reinforcement learning
Ronen I. Brafman and Moshe Tennenholtz · 2001
Earlier work this paper cites.
A tutorial on the cross-entropy method
Pieter-Tjerk De Boer, Dirk P Kroese, Shie Mannor, and Reuven Y Rubinstein · 2005
Earlier work this paper cites.
A survey of monte carlo tree search methods
Cameron B Browne, Edward Powley, Daniel Whitehouse, Simon M Lucas, Peter I Cowling, Philipp Rohlfshagen, Stephen Tavener, Diego Perez, Spyridon Samothrakis, and Simon Colton · 2012
Earlier work this paper cites.
Autonomous agents modelling other agents: A comprehensive survey and open problems
Stefano V. Albrecht and Peter Stone · 2018
Earlier work this paper cites.
Extending world models for multi-agent reinforcement learning in malmö
Valliappa Chockalingam, Tegg Tae Kyong Sung, Feryal Behbahani, Rishab Gargeya, Amlesh Sivanantham, and Aleksandra Malysheva · 2018
Earlier work this paper cites.
Towards optimally decentralized multi-robot collision avoidance via deep reinforcement learning
Pinxin Long, Tingxiang Fan, Xinyi Liao, Wenxi Liu, Hao Zhang, and Jia Pan · 2018
Earlier work this paper cites.
Thanh Thi Nguyen, Ngoc Duy Nguyen, and Saeid Nahavandi · 2018
Earlier work this paper cites.
Mean field multi-agent reinforcement learning
Yaodong Yang, Rui Luo, Minne Li, Ming Zhou, Weinan Zhang, and Jun Wang · 2018
Earlier work this paper cites.
Alphastar: an evolutionary computation perspective
Kai Arulkumaran, Antoine Cully, and Julian Togelius · 2019
Earlier work this paper cites.
When to trust your model: Model-based policy optimization
Michael Janner, Justin Fu, Marvin Zhang, and Sergey Levine · 2019
Earlier work this paper cites.
Multi-agent reinforcement learning with multi-step generative models
Orr Krupnik, Igor Mordatch, and Aviv Tamar · 2019
Earlier work this paper cites.
Dealing with non-stationarity in multi-agent deep reinforcement learning
Georgios Papoudakis, Filippos Christianos, Arrasy Rahman, and Stefano V. Albrecht · 2019
Cited alongside, same era.
Multi-agent reinforcement learning with approximate model learning for competitive games
Young Joon Park, Yoon Sang Cho, and Seoung Bum Kim · 2019
Cited alongside, same era.
Model-based RL in contextual decision processes: PAC bounds and exponential improvements over model-free approaches
Wen Sun, Nan Jiang, Akshay Krishnamurthy, Alekh Agarwal, and John Langford · 2019
Cited alongside, same era.
Benchmarking model-based reinforcement learning
Tingwu Wang, Xuchan Bao, Ignasi Clavera, Jerrick Hoang, Yeming Wen, Eric Langlois, Shunshi Zhang, Guodong Zhang, Pieter Abbeel, and Jimmy Ba · 2019
Cited alongside, same era.
Multi-agent reinforcement learning: A selective overview of theories and algorithms
Kaiqing Zhang, Zhuoran Yang, and Tamer Basar · 2019
Cited alongside, same era.
SMARTS: scalable multi-agent reinforcement learning training school for autonomous driving
Ming Zhou, Jun Luo, Julian Villela, Yaodong Yang, David Rusu, Jiayu Miao, Weinan Zhang, Montgomery Alban, Iman Fadakar, Zheng Chen, Aurora Chongxi Huang, Ying Wen, Kimia Hassanzadeh, Daniel Graves, Dong Chen, Zhengbang Zhu, Nhat M. Nguyen, Mohamed Elsayed, Kun Shao, Sanjeevan Ahilan, Baokuan Zhang, Jiannan Wu, Zhengang Fu, Kasra Rezaee, Peyman Yadmellat, Mohsen Rohani, Nicolas Perez Nieves, Yihan Ni, Seyedershad Banijamali, Alexander Imani Cowen-Rivers, Zheng Tian, Daniel Palenicek, Haitham Bou-Ammar, Hongbo Zhang, Wulong Liu, Jianye Hao, and Jun Wang · 2020
Later among the works it cites.
Cooperative prioritized sweeping
Eugenio Bargiacchi, Timothy Verstraeten, and Diederik M. Roijers · 2021
Later among the works it cites.
A survey on multi-agent deep reinforcement learning: from the perspective of challenges and applications
Wei Du and Shifei Ding · 2021
Later among the works it cites.
Multi-agent deep reinforcement learning: a survey
Sven Gronauer and Klaus Diepold · 2021
Later among the works it cites.
alphaXiv searches the wider corpus for related work and actual follow-ups.
alphaXiv is searching for related work…
Provable self-play algorithms for competitive reinforcement learning
Yu Bai and Chi Jin · 2020
Cited alongside, same era.
The hanabi challenge: A new frontier for AI research
Nolan Bard, Jakob N. Foerster, Sarath Chandar, Neil Burch, Marc Lanctot, H. Francis Song, Emilio Parisotto, Vincent Dumoulin, Subhodeep Moitra, Edward Hughes, Iain Dunning, Shibl Mourad, Hugo Larochelle, Marc G. Bellemare, and Michael Bowling · 2020
Cited alongside, same era.
A very condensed survey and critique of multiagent deep reinforcement learning
Pablo Hernandez-Leal, Bilal Kartal, and Matthew E. Taylor · 2020
Cited alongside, same era.
Google research football: A novel reinforcement learning environment
Karol Kurach, Anton Raichuk, Piotr Stanczyk, Michal Zajac, Olivier Bachem, Lasse Espeholt, Carlos Riquelme, Damien Vincent, Marcin Michalski, Olivier Bousquet, and Sylvain Gelly · 2020
Cited alongside, same era.
Model-based reinforcement learning: A survey
Thomas M. Moerland, Joost Broekens, and Catholijn M. Jonker · 2020
Cited alongside, same era.
Learning to communicate through imagination with model-based deep multi-agent reinforcement learning
Arnu Pretorius, Scott Cameron, Andries Petrus Smit, Elan van Biljon, Lawrence Francis, Femi Azeez, Alexandre Laterre, and Karim Beguir · 2020
Cited alongside, same era.
Model-based reinforcement learning for decentralized multiagent rendezvous
Rose E. Wang, J. Chase Kew, Dennis Lee, Tsang-Wei Edward Lee, Tingnan Zhang, Brian Ichter, Jie Tan, and Aleksandra Faust · 2020
Cited alongside, same era.
Jian Hu, Siyang Jiang, Seth Austin Harding, Haibin Wu, and SW Liao · 2021
Later among the works it cites.
Communication in multi-agent reinforcement learning: Intention sharing
Woojun Kim, Jongeui Park, and Youngchul Sung · 2021
Later among the works it cites.
Tesseract: Tensorised actors for multi-agent reinforcement learning
Anuj Mahajan, Mikayel Samvelyan, Lei Mao, Viktor Makoviychuk, Animesh Garg, Jean Kossaifi, Shimon Whiteson, Yuke Zhu, and Animashree Anandkumar · 2021
Later among the works it cites.
Efficient model-based multi-agent mean-field reinforcement learning
Barna Pásztor, Ilija Bogunovic, and Andreas Krause · 2021
Later among the works it cites.
Robustness and sample complexity of model-based MARL for general-sum markov games
Jayakumar Subramanian, Amit Sinha, and Aditya Mahajan · 2021
Later among the works it cites.
Model based multi-agent reinforcement learning with tensor decompositions
Pascal Van Der Vaart, Anuj Mahajan, and Shimon Whiteson · 2021
Later among the works it cites.
QPLEX: duplex dueling multi-agent q-learning
Jianhao Wang, Zhizhou Ren, Terry Liu, Yang Yu, and Chongjie Zhang · 2021
Later among the works it cites.
MAMBPO: sample-efficient multi-robot reinforcement learning using learned world models
Daniël Willemsen, Mario Coppola, and Guido C. H. E. de Croon · 2021
Later among the works it cites.
Xiaopeng Yu, Jiechuan Jiang, Haobin Jiang, and Zongqing Lu · 2021
Later among the works it cites.
Model-based multi-agent policy optimization with adaptive opponent-wise rollouts
Weinan Zhang, Xihuai Wang, Jian Shen, and Ming Zhou · 2021
Later among the works it cites.