On speaker adaptation of long short-term memory recurrent neural networks
Y. Miao and F. Metze · 2015
Cited alongside, same era.
Speaker adaptive training of deep neural network acoustic models using i-vectors
Y. Miao, H. Zhang, and F. Metze · 2015
Cited alongside, same era.
Librispeech: an ASR corpus based on public domain audio books
V. Panayotov, G. Chen, D. Povey, and S. Khudanpur · 2015
Cited alongside, same era.
A study of speaker adaptation for dnn-based speech synthesis
Z. Wu, P. Swietojanski, C. Veaux, S. Renals, and S. King · 2015
Cited alongside, same era.
Voice morphing that improves tts quality using an optimal dynamic frequency warping-and-weighting transform
Y. Agiomyrgiannakis and Z. Roupakia · 2016
Cited alongside, same era.
Deep speech 2: End-to-end speech recognition in english and mandarin
D. Amodei, S. Ananthanarayanan, R. Anubhai, J. Bai, E. Battenberg, C. Case, J. Casper, B. Catanzaro, Q. Cheng, G. Chen, et al · 2016
Cited alongside, same era.
Exploring the limits of language modeling
Original
R. Jozefowicz, O. Vinyals, M. Schuster, N. Shazeer, and Y. Wu · 2016
Cited alongside, same era.
Samplernn: An unconditional end-to-end neural audio generation model
Original
S. Mehri, K. Kumar, I. Gulrajani, R. Kumar, S. Jain, J. Sotelo, A. Courville, and Y. Bengio · 2016
Cited alongside, same era.
One-shot generalization in deep generative models
D. Rezende, Shakir, I. Danihelka, K. Gregor, and D. Wierstra · 2016
Cited alongside, same era.
Deep neural network-based speaker embeddings for end-to-end speaker verification
D. Snyder, P. Ghahremani, D. Povey, D. Garcia-Romero, Y. Carmiel, and S. Khudanpur · 2016
Cited alongside, same era.
Analysis of the voice conversion challenge 2016 evaluation results
M. Wester, Z. Wu, and J. Yamagishi · 2016
Cited alongside, same era.
Locally linear embedding for exemplar-based spectral conversion
Y.-C. Wu, H.-T. Hwang, C.-C. Hsu, Y. Tsao, and H.-m. Wang · 2016
Cited alongside, same era.