Fetching the paper…
Reading the bibliography…
Neural network pruning offers an effective method for compressing a multilingual automatic speech recognition (ASR) model with minimal performance loss.
“Learning both weights and connections for efficient neural network,”
Song Han, Jeff Pool, John Tran, and William Dally, · 2015
Earlier work this paper cites.
“Exploring sparsity in recurrent neural networks,”
Sharan Narang, Greg Diamos, Shubho Sengupta, and Erich Elsen, · 2017
Earlier work this paper cites.
“To prune, or not to prune: Exploring the efficacy of pruning for model compression,”
Michael H. Zhu and Suyog Gupta, · 2018
Earlier work this paper cites.
“Streaming end-to-end speech recognition for mobile devices,”
Yanzhang He, Tara N Sainath, Rohit Prabhavalkar, Ian McGraw, Raziel Alvarez, Ding Zhao, David Rybach, Anjuli Kannan, Yonghui Wu, Ruoming Pang, et al., · 2019
Earlier work this paper cites.
“The lottery ticket hypothesis: Finding sparse, trainable neural networks,”
Jonathan Frankle and Michael Carbin, · 2019
Earlier work this paper cites.
“Optimizing speech recognition for the edge,”
Yuan Shangguan, Jian Li, Qiao Liang, Raziel Alvarez, and Ian McGraw, · 2019
Earlier work this paper cites.
“Large-Scale Multilingual Speech Recognition with a Streaming End-to-End Model,”
Anjuli Kannan, Arindrima Datta, Tara N. Sainath, Eugene Weinstein, Bhuvana Ramabhadran, Yonghui Wu, Ankur Bapna, Zhifeng Chen, and Seungji Lee, · 2019
Earlier work this paper cites.
“SpecAugment: A Simple Data Augmentation Method for Automatic Speech Recognition,”
Daniel S. Park, William Chan, Yu Zhang, Chung-Cheng Chiu, Barret Zoph, Ekin D. Cubuk, and Quoc V. Le, · 2019
Earlier work this paper cites.
“Massively Multilingual ASR: 50 Languages, 1 Model, 1 Billion Parameters,”
Vineel Pratap, Anuroop Sriram, Paden Tomasello, Awni Hannun, Vitaliy Liptchinsky, Gabriel Synnaeve, and Ronan Collobert, · 2020
Earlier work this paper cites.
“Comparing rewinding and fine-tuning in neural network pruning,”
Alex Renda, Jonathan Frankle, and Michael Carbin, · 2020
Earlier work this paper cites.
“Language-agnostic multilingual modeling,”
Arindrima Datta, Bhuvana Ramabhadran, Jesse Emond, Anjuli Kannan, and Brian Roark, · 2020
Cited alongside, same era.
“Gradient surgery for multi-task learning,”
Tianhe Yu, Saurabh Kumar, Abhishek Gupta, Sergey Levine, Karol Hausman, and Chelsea Finn, · 2020
Cited alongside, same era.
“Learning sparse sharing architectures for multiple tasks,”
Tianxiang Sun, Yunfan Shao, Xiaonan Li, Pengfei Liu, Hang Yan, Xipeng Qiu, and Xuanjing Huang, · 2020
Cited alongside, same era.
“Mls: A large-scale multilingual dataset for speech research,”
Vineel Pratap, Qiantong Xu, Anuroop Sriram, Gabriel Synnaeve, and Ronan Collobert, · 2020
Cited alongside, same era.
“Conformer: Convolution-augmented Transformer for Speech Recognition,”
Anmol Gulati, James Qin, Chung-Cheng Chiu, Niki Parmar, Yu Zhang, Jiahui Yu, Wei Han, Shibo Wang, Zhengdong Zhang, Yonghui Wu, and Ruoming Pang, · 2020
Cited alongside, same era.
“Emformer: Efficient memory transformer based acoustic model for low latency streaming speech recognition,”
Yangyang Shi, Yongqiang Wang, Chunyang Wu, Ching-Feng Yeh, Julian Chan, Frank Zhang, Duc Le, and Mike Seltzer, · 2021
Later among the works it cites.
“Intriguing properties of compression on multilingual models,”
Kelechi Ogueji, Orevaoghene Ahia, Gbemileke Onilude, Sebastian Gehrmann, Sara Hooker, and Julia Kreutzer, · 2022
Later among the works it cites.
“Language adaptive cross-lingual speech representation learning with sparse sharing sub-networks,”
Yizhou Lu, Mingkun Huang, Xinghua Qu, Pengfei Wei, and Zejun Ma, · 2022
Later among the works it cites.
“Discovering language-neutral sub-networks in multilingual language models,”
Negar Foroutan, Mohammadreza Banaei, Rémi Lebret, Antoine Bosselut, and Karl Aberer, · 2022
Later among the works it cites.
“Losses can be blessings: Routing self-supervised speech representations towards efficient multilingual and multitask speech processing,”
Yonggan Fu, Yang Zhang, Kaizhi Qian, Zhifan Ye, Zhongzhi Yu, Cheng-I Jeff Lai, and Celine Lin, · 2022
alphaXiv searches the wider corpus for related work and actual follow-ups.
alphaXiv is searching for related work…
“Dissecting User-Perceived Latency of On-Device E2E Speech Recognition,”
Yuan Shangguan, Rohit Prabhavalkar, Hang Su, Jay Mahadeokar, Yangyang Shi, Jiatong Zhou, Chunyang Wu, Duc Le, Ozlem Kalinli, Christian Fuegen, and Michael L. Seltzer, · 2021
Cited alongside, same era.
“Extremely Low Footprint End-to-End ASR System for Smart Device,”
Zhifu Gao, Yiwu Yao, Shiliang Zhang, Jun Yang, Ming Lei, and Ian McLoughlin, · 2021
Cited alongside, same era.
“Adapt-and-Adjust: Overcoming the Long-Tail Problem of Multilingual Speech Recognition,”
Genta Indra Winata, Guangsen Wang, Caiming Xiong, and Steven Hoi, · 2021
Cited alongside, same era.
“Learning language specific sub-network for multilingual machine translation,”
Zehui Lin, Liwei Wu, Mingxuan Wang, and Lei Li, · 2021
Cited alongside, same era.
“Parp: Prune, adjust and re-prune for self-supervised speech recognition,”
Cheng-I Jeff Lai, Yang Zhang, Alexander H Liu, Shiyu Chang, Yi-Lun Liao, Yung-Sung Chuang, Kaizhi Qian, Sameer Khurana, David Cox, and Jim Glass, · 2021
Cited alongside, same era.
Later among the works it cites.
“Omni-sparsity dnn: Fast sparsity optimization for on-device streaming e2e asr via supernet,”
Haichuan Yang, Yuan Shangguan, Dilin Wang, Meng Li, Pierce Chuang, Xiaohui Zhang, Ganesh Venkatesh, Ozlem Kalinli, and Vikas Chandra, · 2022
Later among the works it cites.
“Massively multilingual asr on 70 languages: Tokenization, architecture, and generalization capabilities,”
Andros Tjandra, Nayan Singhal, David Zhang, Ozlem Kalinli, Abdelrahman Mohamed, Duc Le, and Michael L Seltzer, · 2023
Closest in time.
“Learning asr pathways: A sparse multilingual asr model,”
Mu Yang, Andros Tjandra, Chunxi Liu, David Zhang, Duc Le, and Ozlem Kalinli, · 2023
Closest in time.
“Causes and cures for interference in multilingual translation,”
Uri Shaham, Maha Elbayad, Vedanuj Goswami, Omer Levy, and Shruti Bhosale, · 2023
Closest in time.
“Learning a dual-mode speech recognition model via self-pruning,”
Chunxi Liu, Yuan Shangguan, Haichuan Yang, Yangyang Shi, Raghuraman Krishnamoorthi, and Ozlem Kalinli, · 2023
Closest in time.