“Does Learning Require Memorization? A Short Tale about a Long Tail” Extended abstract in STOC 2020
Original
Vitaly Feldman · 1906
Earlier work this paper cites.
“Residuals and influence in regression”
R Cook and Sanford Weisberg · 1982
Earlier work this paper cites.
“Characterizing Structural Regularities of Labeled Data in Overparameterized Models”
Original
Ziheng Jiang, Chiyuan Zhang, Kunal Talwar and Michael. Mozer · 2002
Earlier work this paper cites.
“Estimating Training Data Influence by Tracking Gradient Descent”, 2020
Original
Garima Pruthi, Frederick Liu, Mukund Sundararajan and Satyen Kale · 2002
Earlier work this paper cites.
“Capturing long-tail distributions of object subcategories”
Xiangxin Zhu, Dragomir Anguelov and Deva Ramanan · 2014
Earlier work this paper cites.
“TensorFlow: Large-Scale Machine Learning on Heterogeneous Systems” Software available from tensorflow.org, 2015
Mart“’n Abadi et al · 2015
Earlier work this paper cites.
“Going deeper with convolutions”
Christian Szegedy, Wei Liu, Yangqing Jia, Pierre Sermanet, Scott Reed, Dragomir Anguelov, Dumitru Erhan, Vincent Vanhoucke and Andrew Rabinovich · 2015
Earlier work this paper cites.
“Deep Residual Learning for Image Recognition”
K. He, X. Zhang, S. Ren and J. Sun · 2016
Earlier work this paper cites.
“A closer look at memorization in deep networks”
Devansh Arpit, Stanislaw Jastrzkebski, Nicolas Ballas, David Krueger, Emmanuel Bengio, Maxinder Kanwal, Tegan Maharaj, Asja Fischer, Aaron Courville and Yoshua Bengio · 2017
Earlier work this paper cites.
“Densely connected convolutional networks”
Gao Huang, Zhuang Liu, Laurens Van Der and Kilian Weinberger · 2017
Earlier work this paper cites.
“Understanding black-box predictions via influence functions”
Pang Koh and Percy Liang · 2017
Earlier work this paper cites.
“Exploring generalization in deep learning”
Behnam Neyshabur, Srinadh Bhojanapalli, David McAllester and Nati Srebro · 2017
Earlier work this paper cites.