Neural architecture search with reinforcement learning
Zoph, B. and Le, Q. V · 2017
Cited alongside, same era.
Dropblock: A regularization method for convolutional networks
Ghiasi, G., Lin, T.-Y., and Le, Q. V · 2018
Cited alongside, same era.
Frage: Frequency-agnostic word representation
Gong, C., He, D., Tan, X., Qin, T., Wang, L., and Liu, T.-Y · 2018
Cited alongside, same era.
Dynamic evaluation of neural sequence models
Krause, B., Kahembwe, E., Murray, I., and Renals, S · 2018
Cited alongside, same era.
Regularizing and optimizing lstm language models
Merity, S., Keskar, N. S., and Socher, R · 2018
Cited alongside, same era.
Adversarially robust generalization requires more data
Schmidt, L., Santurkar, S., Tsipras, D., Talwar, K., and Madry, A · 2018
Cited alongside, same era.
Ensemble adversarial training: Attacks and defenses
Tramèr, F., Kurakin, A., Papernot, N., Goodfellow, I., Boneh, D., and McDaniel, P · 2018
Cited alongside, same era.
Breaking the softmax bottleneck: A high-rank RNN language model
Yang, Z., Dai, Z., Salakhutdinov, R., and Cohen, W. W · 2018
Cited alongside, same era.
mixup: Beyond empirical risk minimization
Zhang, H., Cisse, M., Dauphin, Y. N., and Lopez-Paz, D · 2018
Cited alongside, same era.
Proxylessnas: Direct neural architecture search on target task and hardware
Cai, H., Zhu, L., and Han, S · 2019
Cited alongside, same era.
Certified adversarial robustness via randomized smoothing
Cohen, J. M., Rosenfeld, E., and Kolter, J. Z · 2019
Cited alongside, same era.
Bert: Pre-training of deep bidirectional transformers for language understanding
Devlin, J., Chang, M.-W., Lee, K., and Toutanova, K · 2019
Cited alongside, same era.