Catastrophic forgetting, rehearsal and pseudorehearsal
Robins, A · 1995
Earlier work this paper cites.
Catastrophic forgetting in connectionist networks
French, R. M · 1999
Earlier work this paper cites.
An empirical investigation of catastrophic forgetting in gradient-based neural networks
Original
Goodfellow, I. J., Mirza, M., Xiao, D., Courville, A., and Bengio, Y · 2013
Earlier work this paper cites.
Policy shaping: Integrating human feedback with reinforcement learning
Griffith, S., Subramanian, K., Scholz, J., Isbell, C. L., and Thomaz, A. L · 2013
Earlier work this paper cites.
Recursive deep models for semantic compositionality over a sentiment treebank
Socher, R., Perelygin, A., Wu, J., Chuang, J., Manning, C. D., Ng, A. Y., and Potts, C · 2013
Earlier work this paper cites.
Explaining and harnessing adversarial examples
Original
Goodfellow, I. J., Shlens, J., and Szegedy, C · 2014
Earlier work this paper cites.
Adding gradient noise improves learning for very deep networks
Original
Neelakantan, A., Vilnis, L., Le, Q. V., Sutskever, I., Kaiser, L., Kurach, K., and Martens, J · 2015
Earlier work this paper cites.
Character-level convolutional networks for text classification
Zhang, X., Zhao, J., and LeCun, Y · 2015
Earlier work this paper cites.
Model-agnostic meta-learning for fast adaptation of deep networks
Finn, C., Abbeel, P., and Levine, S · 2017
Earlier work this paper cites.
Overcoming catastrophic forgetting in neural networks
Kirkpatrick, J., Pascanu, R., Rabinowitz, N., Veness, J., Desjardins, G., Rusu, A. A., Milan, K., Quan, J., Ramalho, T., Grabska-Barwinska, A., et al · 2017
Earlier work this paper cites.
Learning without forgetting
Li, Z. and Hoiem, D · 2017
Earlier work this paper cites.
Decoupled weight decay regularization
Original
Loshchilov, I. and Hutter, F · 2017
Earlier work this paper cites.
Measuring catastrophic forgetting in neural networks
Kemker, R., McClure, M., Abitino, A., Hayes, T., and Kanan, C · 2018
Earlier work this paper cites.
Overcoming catastrophic forgetting with hard attention to the task
Serra, J., Suris, D., Miron, M., and Karatzoglou, A · 2018
Earlier work this paper cites.
Meta-learning representations for continual learning
Javed, K. and White, M · 2019
Earlier work this paper cites.
Sharpness-aware minimization for efficiently improving generalization
Original
Foret, P., Kleiner, A., Mobahi, H., and Neyshabur, B · 2020
Earlier work this paper cites.
Remind your neural network to prevent catastrophic forgetting
Hayes, T. L., Kafle, K., Shrestha, R., Acharya, M., and Kanan, C · 2020
Earlier work this paper cites.
Weight poisoning attacks on pre-trained models
Original
Kurita, K., Michel, P., and Neubig, G · 2020
Earlier work this paper cites.
A general language assistant as a laboratory for alignment
Original
Askell, A., Bai, Y., Chen, A., Drain, D., Ganguli, D., Henighan, T., Jones, A., Joseph, N., Mann, B., DasSarma, N., et al · 2021
Earlier work this paper cites.
Training verifiers to solve math word problems
Original
Cobbe, K., Kosaraju, V., Bavarian, M., Chen, M., Jun, H., Kaiser, L., Plappert, M., Tworek, J., Hilton, J., Nakano, R., et al · 2021
Earlier work this paper cites.
Lora: Low-rank adaptation of large language models
Original
Hu, E. J., Shen, Y., Wallis, P., Allen-Zhu, Z., Li, Y., Wang, S., Wang, L., and Chen, W · 2021
Earlier work this paper cites.
Defending against backdoors in federated learning with robust learning rate
Ozdayi, M. S., Kantarcioglu, M., and Gel, Y. R · 2021
Earlier work this paper cites.
Training a helpful and harmless assistant with reinforcement learning from human feedback
Original
Bai, Y., Jones, A., Ndousse, K., Askell, A., Chen, A., DasSarma, N., Drain, D., Fort, S., Ganguli, D., Henighan, T., et al · 2022
Earlier work this paper cites.
Achieving personalized federated learning with sparse local models
Original
Huang, T., Liu, S., Shen, L., He, F., Lin, W., and Tao, D · 2022
Earlier work this paper cites.
Make sharpness-aware minimization stronger: A sparsified perturbation approach
Mi, P., Shen, L., Ren, T., Zhou, Y., Sun, X., Ji, R., and Tao, D · 2022
Earlier work this paper cites.
Training language models to follow instructions with human feedback
Ouyang, L., Wu, J., Jiang, X., Almeida, D., Wainwright, C., Mishkin, P., Zhang, C., Agarwal, S., Slama, K., Ray, A., et al · 2022
Earlier work this paper cites.