Adam: A method for stochastic optimization
Kingma, D. P.; and Ba, J. 2015 · 2015
Cited alongside, same era.
Layer normalization
Original
Ba, J. L.; Kiros, J. R.; and Hinton, G. E. 2016 · 2016
Cited alongside, same era.
Wavenet: A generative model for raw audio
Original
Oord, A. v. d.; Dieleman, S.; Zen, H.; Simonyan, K.; Vinyals, O.; Graves, A.; Kalchbrenner, N.; Senior, A.; and Kavukcuoglu, K. 2016 · 2016
Cited alongside, same era.
Least squares generative adversarial networks
Mao, X.; Li, Q.; Xie, H.; Lau, R. Y.; Wang, Z.; and Paul Smolley, S. 2017 · 2017
Cited alongside, same era.
Attention is All you Need
Vaswani, A.; Shazeer, N.; Parmar, N.; Uszkoreit, J.; Jones, L.; Gomez, A. N.; Kaiser, Ł.; and Polosukhin, I. 2017 · 2017
Cited alongside, same era.
Tacotron: Towards end-to-end speech synthesis
Original
Wang, Y.; Skerry-Ryan, R.; Stanton, D.; Wu, Y.; Weiss, R. J.; Jaitly, N.; Yang, Z.; Xiao, Y.; Chen, Z.; Bengio, S.; et al. 2017 · 2017
Cited alongside, same era.
mixup: Beyond empirical risk minimization
Original
Zhang, H.; Cisse, M.; Dauphin, Y. N.; and Lopez-Paz, D. 2017 · 2017
Cited alongside, same era.
FloWaveNet: A generative flow for raw audio
Original
Kim, S.; Lee, S.-g.; Song, J.; Kim, J.; and Yoon, S. 2018 · 2018
Cited alongside, same era.
Parallel wavenet: Fast high-fidelity speech synthesis
Oord, A.; Li, Y.; Babuschkin, I.; Simonyan, K.; Vinyals, O.; Kavukcuoglu, K.; Driessche, G.; Lockhart, E.; Cobo, L.; Stimberg, F.; et al. 2018 · 2018
Cited alongside, same era.
Natural tts synthesis by conditioning wavenet on mel spectrogram predictions
Shen, J.; Pang, R.; Weiss, R. J.; Schuster, M.; Jaitly, N.; Yang, Z.; Chen, Z.; Zhang, Y.; Wang, Y.; Skerrv-Ryan, R.; et al. 2018 · 2018
Cited alongside, same era.
Towards End-to-End Prosody Transfer for Expressive Speech Synthesis with Tacotron
Skerry-Ryan, R.; Battenberg, E.; Xiao, Y.; Wang, Y.; Stanton, D.; Shor, J.; Weiss, R.; Clark, R.; and Saurous, R. A. 2018 · 2018
Cited alongside, same era.