Dissecting the NVIDIA Volta GPU architecture via microbenchmarking
Original
Z. Jia, M. Maggioni, B. Staiger, and D. P. Scarpazza · 2018
Cited alongside, same era.
Quantizing deep convolutional networks for efficient inference: A whitepaper
Original
R. Krishnamoorthi · 2018
Cited alongside, same era.
NVIDIA tensor core programmability, performance & precision
S. Markidis, S. W. Der Chien, E. Laure, I. B. Peng, and J. S. Vetter · 2018
Cited alongside, same era.
The dark side of DNN pruning
R. Yazdani, M. Riera, J.-M. Arnau, and A. González · 2018
Cited alongside, same era.
Post training 4-bit quantization of convolutional networks for rapid-deployment
R. Banner, Y. Nahshan, and D. Soudry · 2019
Cited alongside, same era.
Low-bit quantization of neural networks for efficient inference
Y. Choukroun, E. Kravchik, F. Yang, and P. Kisilev · 2019
Cited alongside, same era.
BiScaled-DNN: Quantizing long-tailed datastructures with two scale factors for deep neural networks
S. Jain, S. Venkataramani, V. Srinivasan, J. Choi, K. Gopalakrishnan, and L. Chang · 2019
Cited alongside, same era.
PyTorch: An imperative style, high-performance deep learning library
A. Paszke, S. Gross, F. Massa, A. Lerer, J. Bradbury, G. Chanan, T. Killeen, Z. Lin, N. Gimelshein, L. Antiga, A. Desmaison, A. Kopf, E. Yang, Z. DeVito, M. Raison, A. Tejani, S. Chilamkurthy, B. Steiner, L. Fang, J. Bai, and S. Chintala · 2019
Cited alongside, same era.
Modeling deep learning accelerator enabled GPUs
M. A. Raihan, N. Goli, and T. M. Aamodt · 2019
Cited alongside, same era.
SinGAN: Learning a generative model from a single natural image
T. R. Shaham, T. Dekel, and T. Michaeli · 2019
Cited alongside, same era.
SMT-SA: Simultaneous multithreading in systolic arrays
G. Shomron, T. Horowitz, and U. Weiser · 2019
Cited alongside, same era.
Hybrid 8-bit floating point (HFP8) training and inference for deep neural networks
X. Sun, J. Choi, C.-Y. Chen, N. Wang, S. Venkataramani, V. V. Srinivasan, X. Cui, W. Zhang, and K. Gopalakrishnan · 2019
Cited alongside, same era.