Janus-iii: Speech-to-speech translation in multiple languages
Alon Lavie, Alex Waibel, Lori Levin, Michael Finke, Donna Gates, Marsal Gavalda, Torsten Zeppenfeld, and Puming Zhan · 1997
Earlier work this paper cites.
Bleu: a method for automatic evaluation of machine translation
Kishore Papineni, Salim Roukos, Todd Ward, and Wei-Jing Zhu · 2002
Earlier work this paper cites.
The atr multilingual speech-to-speech translation system
Satoshi Nakamura, Konstantin Markov, Hiromi Nakaiwa, Gen-ichiro Kikui, Hisashi Kawai, Takatoshi Jitsuhiro, J-S Zhang, Hirofumi Yamamoto, Eiichiro Sumita, and Seiichi Yamamoto · 2006
Earlier work this paper cites.
Covost 2 and massively multilingual speech-to-text translation
Original
Changhan Wang, Anne Wu, and Juan Pino · 2007
Earlier work this paper cites.
Verbmobil: foundations of speech-to-speech translation
Wolfgang Wahlster · 2013
Earlier work this paper cites.
Non-autoregressive neural machine translation
Original
Jiatao Gu, James Bradbury, Caiming Xiong, Victor OK Li, and Richard Socher · 2017
Earlier work this paper cites.
Attention is all you need
Ashish Vaswani, Noam Shazeer, Niki Parmar, Jakob Uszkoreit, Llion Jones, Aidan N Gomez, Łukasz Kaiser, and Illia Polosukhin · 2017
Earlier work this paper cites.
Bert: Pre-training of deep bidirectional transformers for language understanding
Original
Jacob Devlin, Ming-Wei Chang, Kenton Lee, and Kristina Toutanova · 2018
Earlier work this paper cites.
Effectiveness of self-supervised pre-training for speech recognition
Original
Alexei Baevski, Michael Auli, and Abdelrahman Mohamed · 2019
Earlier work this paper cites.
Unsupervised speech representation learning using wavenet autoencoders
Jan Chorowski, Ron J Weiss, Samy Bengio, and Aäron Van Den Oord · 2019
Earlier work this paper cites.
An unsupervised autoregressive model for speech representation learning
Original
Yu-An Chung, Wei-Ning Hsu, Hao Tang, and James Glass · 2019
Earlier work this paper cites.
Transformer-xl: Attentive language models beyond a fixed-length context
Original
Zihang Dai, Zhilin Yang, Yiming Yang, Jaime Carbonell, Quoc V Le, and Ruslan Salakhutdinov · 2019
Earlier work this paper cites.
Mask-predict: Parallel decoding of conditional masked language models
Original
Marjan Ghazvininejad, Omer Levy, Yinhan Liu, and Luke Zettlemoyer · 2019
Earlier work this paper cites.
Levenshtein transformer
Jiatao Gu, Changhan Wang, and Junbo Zhao · 2019
Earlier work this paper cites.
Direct speech-to-speech translation with a sequence-to-sequence model
Original
Ye Jia, Ron J Weiss, Fadi Biadsy, Wolfgang Macherey, Melvin Johnson, Zhifeng Chen, and Yonghui Wu · 2019
Earlier work this paper cites.
fairseq: A fast, extensible toolkit for sequence modeling
Original
Myle Ott, Sergey Edunov, Alexei Baevski, Angela Fan, Sam Gross, Nathan Ng, David Grangier, and Michael Auli · 2019
Earlier work this paper cites.
Attention-based wavenet autoencoder for universal voice conversion
Adam Polyak and Lior Wolf · 2019
Earlier work this paper cites.