Invariant risk minimization
Original
M. Arjovsky, L. Bottou, I. Gulrajani, and D. Lopez-Paz · 2019
Later among the works it cites.
Task-relevant adversarial imitation learning
Original
K. Zolna, S. Reed, A. Novikov, S. G. Colmenarejo, D. Budden, S. Cabi, M. Denil, N. de Freitas, and Z. Wang · 2019
Later among the works it cites.
Language models are few-shot learners
Original
T. B. Brown, B. Mann, N. Ryder, M. Subbiah, J. Kaplan, P. Dhariwal, A. Neelakantan, P. Shyam, G. Sastry, A. Askell, et al · 2020
Later among the works it cites.
Causally correct partial models for reinforcement learning
Original
D. J. Rezende, I. Danihelka, G. Papamakarios, N. R. Ke, R. Jiang, T. Weber, K. Gregor, H. Merzic, F. Viola, J. Wang, et al · 2020
Later among the works it cites.
On the opportunities and risks of foundation models
Original
R. Bommasani, D. A. Hudson, E. Adeli, R. Altman, S. Arora, S. von Arx, M. S. Bernstein, J. Bohg, A. Bosselut, E. Brunskill, E. Brynjolfsson, S. Buch, D. Card, R. Castellon, N. Chatterji, A. S. Chen, K. Creel, J. Q. Davis, D. Demszky, C. Donahue, M. Doumbouya, E. Durmus, S. Ermon, J. Etchemendy, K. Ethayarajh, L. Fei-Fei, C. Finn, T. Gale, L. Gillespie, K. Goel, N. D. Goodman, S. Grossman, N. Guha, T. Hashimoto, P. Henderson, J. Hewitt, D. E. Ho, J. Hong, K. Hsu, J. Huang, T. Icard, S. Jain, D. Jurafsky, P. Kalluri, S. Karamcheti, G. Keeling, F. Khani, O. Khattab, P. W. Koh, M. S. Krass, R. Krishna, R. Kuditipudi, and et al · 2021
Closest in time.
Decision transformer: Reinforcement learning via sequence modeling
Original
L. Chen, K. Lu, A. Rajeswaran, K. Lee, A. Grover, M. Laskin, P. Abbeel, A. Srinivas, and I. Mordatch · 2021
Closest in time.
Causal analysis of agent behavior for ai safety
Original
G. Déletang, J. Grau-Moya, M. Martic, T. Genewein, T. McGrath, V. Mikulik, M. Kunesch, S. Legg, and P. A. Ortega · 2021
Closest in time.
Reinforcement learning as one big sequence modeling problem
Original
M. Janner, Q. Li, and S. Levine · 2021
Closest in time.