Fetching the paper…
Reading the bibliography…
This work explores better adaptation methods to low-resource languages using an external language model (LM) under the framework of transfer learning.
“Long short-term memory,”
Sepp Hochreiter and Jürgen Schmidhuber, · 1997
Earlier work this paper cites.
“Corpus of Spontaneous Japanese: Its design and evaluation,”
Kikuo Maekawa, · 2003
Earlier work this paper cites.
“Connectionist temporal classification: labelling unsegmented sequence data with recurrent neural networks,”
Alex Graves, Santiago Fernández, Faustino Gomez, and Jürgen Schmidhuber, · 2006
Earlier work this paper cites.
“The Kaldi speech recognition toolkit,”
Daniel Povey, Arnab Ghoshal, Gilles Boulianne, Lukas Burget, Ondrej Glembek, Nagendra Goel, Mirko Hannemann, Petr Motlicek, Yanmin Qian, Petr Schwarz, et al., · 2011
Earlier work this paper cites.
“The language-independent bottleneck features,”
Karel Veselỳ, Martin Karafiát, František Grézl, Miloš Janda, and Ekaterina Egorova, · 2012
Earlier work this paper cites.
“Adadelta: an adaptive learning rate method,”
Matthew D Zeiler, · 2012
Earlier work this paper cites.
“Adapting multilingual neural network hierarchy to a new language,”
Frantisek Grézl and Martin Karafiát, · 2014
Earlier work this paper cites.
“Multilingual deep neural network based acoustic modeling for rapid language adaptation,”
Ngoc Thang Vu, David Imseng, Daniel Povey, Petr Motlicek, Tanja Schultz, and Hervé Bourlard, · 2014
Earlier work this paper cites.
“Speech recognition and keyword spotting for low-resource languages: BABEL project research at CUED,”
Mark JF Gales, Kate M Knill, Anton Ragni, and Shakti P Rath, · 2014
Earlier work this paper cites.
“Very deep convolutional networks for large-scale image recognition,”
Karen Simonyan and Andrew Zisserman, · 2014
Earlier work this paper cites.
“Neural machine translation by jointly learning to align and translate,”
Dzmitry Bahdanau, Kyunghyun Cho, and Yoshua Bengio, · 2015
Earlier work this paper cites.
“Attention-based models for speech recognition,”
Jan K Chorowski, Dzmitry Bahdanau, Dmitriy Serdyuk, Kyunghyun Cho, and Yoshua Bengio, · 2015
Earlier work this paper cites.
“On using monolingual corpora in neural machine translation,”
Caglar Gulcehre, Orhan Firat, Kelvin Xu, Kyunghyun Cho, Loic Barrault, Huei-Chi Lin, Fethi Bougares, Holger Schwenk, and Yoshua Bengio, · 2015
Earlier work this paper cites.
“Librispeech: an ASR corpus based on public domain audio books,”
Vassil Panayotov, Guoguo Chen, Daniel Povey, and Sanjeev Khudanpur, · 2015
Cited alongside, same era.
“Scheduled sampling for sequence prediction with recurrent neural networks,”
Samy Bengio, Oriol Vinyals, Navdeep Jaitly, and Noam Shazeer, · 2015
Cited alongside, same era.
“Listen, attend and spell: A neural network for large vocabulary conversational speech recognition,”
William Chan, Navdeep Jaitly, Quoc Le, and Oriol Vinyals, · 2016
Cited alongside, same era.
“Hybrid CTC/attention architecture for end-to-end speech recognition,”
Shinji Watanabe, Takaaki Hori, Suyoun Kim, John R Hershey, and Tomoki Hayashi, · 2017
Cited alongside, same era.
“Multilingual training and cross-lingual adaptation on CTC-based acoustic model,”
Sibo Tong, Philip N Garner, and Hervé Bourlard, · 2017
Cited alongside, same era.
“Sequence-based multi-lingual low resource speech recognition,”
Siddharth Dalmia, Ramon Sanabria, Florian Metze, and Alan W Black, · 2018
Closest in time.
“Multilingual sequence-to-sequence speech recognition: architecture, transfer learning, and language modeling,”
Jaejin Cho, Murali Karthick Baskar, Ruizhi Li, Matthew Wiesner, Sri Harish Mallidi, Nelson Yalta, Martin Karafiat, Shinji Watanabe, and Takaaki Hori, · 2018
Closest in time.
“Cross-lingual adaptation of a CTC-based multilingual acoustic model,”
Sibo Tong, Philip N Garner, and Hervé Bourlard, · 2018
Closest in time.
“Analysis of multilingual blstm acoustic model on low and high resource languages,”
Martin Karafiát, Murali Karthick Baskar, Karel Veselỳ, František Grézl, Lukáš Burget, et al., · 2018
Closest in time.
“Multilingual adaptation of RNN based ASR systems,”
Markus Müller, Sebastian Stüker, and Alex Waibel, · 2018
Closest in time.
alphaXiv searches the wider corpus for related work and actual follow-ups.
alphaXiv is searching for related work…
“Language independent end-to-end architecture for joint language identification and speech recognition,”
Shinji Watanabe, Takaaki Hori, and John R Hershey, · 2017
Cited alongside, same era.
“An analysis of incorporating an external language model into a sequence-to-sequence model,”
Anjuli Kannan, Yonghui Wu, Patrick Nguyen, Tara N Sainath, Zhifeng Chen, and Rohit Prabhavalkar, · 2017
Cited alongside, same era.
“Unsupervised pretraining for sequence to sequence learning,”
Prajit Ramachandran, Peter J Liu, and Quoc V Le, · 2017
Cited alongside, same era.
“Using target-side monolingual data for neural machine translation through multi-task learning,”
Tobias Domhan and Felix Hieber, · 2017
Cited alongside, same era.
“Joint CTC-attention based end-to-end speech recognition using multi-task learning,”
Suyoun Kim, Takaaki Hori, and Shinji Watanabe, · 2017
Cited alongside, same era.
“Automatic differentiation in PyTorch,”
Adam Paszke, Sam Gross, Soumith Chintala, Gregory Chanan, Edward Yang, Zachary DeVito, Zeming Lin, Alban Desmaison, Luca Antiga, and Adam Lerer, · 2017
Cited alongside, same era.
“State-of-the-art speech recognition with sequence-to-sequence models,”
Chung-Cheng Chiu, Tara N Sainath, Yonghui Wu, Rohit Prabhavalkar, Patrick Nguyen, Zhifeng Chen, Anjuli Kannan, Ron J Weiss, Kanishka Rao, Katya Gonina, et al., · 2018
Cited alongside, same era.
Shubham Toshniwal, Tara N Sainath, Ron J Weiss, Bo Li, Pedro Moreno, Eugene Weinstein, and Kanishka Rao, · 2018
Closest in time.
“Towards language-universal end-to-end speech recognition,”
Suyoun Kim and Michael L Seltzer, · 2018
Closest in time.
“A comparison of techniques for language model integration in encoder-decoder speech recognition,”
Shubham Toshniwal, Anjuli Kannan, Chung-Cheng Chiu, Yonghui Wu, Tara N Sainath, and Karen Livescu, · 2018
Closest in time.
“Cold fusion: Training seq2seq models together with language models,”
Anuroop Sriram, Heewoo Jun, Sanjeev Satheesh, and Adam Coates, · 2018
Closest in time.
“Back-translation-style data augmentation for end-to-end ASR,”
Tomoki Hayashi, Shinji Watanabe, Yu Zhang, Tomoki Toda, Takaaki Hori, Ramon Astudillo, and Kazuya Takeda, · 2018
Closest in time.
“Leveraging sequence-to-sequence speech synthesis for enhancing acoustic-to-word speech recognition,”
Masato Mimura, Sei Ueno, Hirofumi Inaguma, Shinsuke Sakai, and Tatsuya Kawahara, · 2018
Closest in time.
“ESPnet: End-to-End Speech Processing Toolkit,”
Shinji Watanabe, Takaaki Hori, Shigeki Karita, Tomoki Hayashi, Jiro Nishitoba, Yuya Unno, Nelson Enrique Yalta Soplin, Jahn Heymann, Matthew Wiesner, Nanxin Chen, et al., · 2018
Closest in time.