Fetching the paper…
Reading the bibliography…
Robust speech processing in multi-talker environments requires effective speech separation.
“Performance measurement in blind audio source separation,”
Emmanuel Vincent, Rémi Gribonval, and Cédric Févotte, · 2006
Earlier work this paper cites.
“Curriculum learning,”
Yoshua Bengio, Jérôme Louradour, Ronan Collobert, and Jason Weston, · 2009
Earlier work this paper cites.
“Nonnegative least-correlated component analysis for separation of dependent sources by volume maximization,”
Fa-Yu Wang, Chong-Yung Chi, Tsung-Han Chan, and Yue Wang, · 2010
Earlier work this paper cites.
“Convex and semi-nonnegative matrix factorizations,”
Chris HQ Ding, Tao Li, and Michael I Jordan, · 2010
Earlier work this paper cites.
“Online learning and generalization of parts-based image representations by non-negative sparse autoencoders,”
Andre Lemme, René Felix Reinhart, and Jochen Jakob Steil, · 2012
Earlier work this paper cites.
“Adam: A method for stochastic optimization,”
Diederik Kingma and Jimmy Ba, · 2014
Earlier work this paper cites.
“Joint optimization of masks and deep recurrent neural networks for monaural source separation,”
Po-Sen Huang, Minje Kim, Mark Hasegawa-Johnson, and Paris Smaragdis, · 2015
Earlier work this paper cites.
“Phase-sensitive and recognition-boosted speech separation using deep recurrent neural networks,”
Hakan Erdogan, John R Hershey, Shinji Watanabe, and Jonathan Le Roux, · 2015
Earlier work this paper cites.
“Learning the speech front-end with raw waveform cldnns,”
Tara N Sainath, Ron J Weiss, Andrew Senior, Kevin W Wilson, and Oriol Vinyals, · 2015
Earlier work this paper cites.
“Learning understandable neural networks with nonnegative weight constraints,”
Jan Chorowski and Jacek M Zurada, · 2015
Earlier work this paper cites.
“A deep ensemble learning method for monaural speech separation,”
Xiao-Lei Zhang and DeLiang Wang, · 2016
Cited alongside, same era.
“Single-channel multi-speaker separation using deep clustering,”
Yusuf Isik, Jonathan Le Roux, Zhuo Chen, Shinji Watanabe, and John R Hershey, · 2016
Cited alongside, same era.
“Complex ratio masking for monaural speech separation,”
Donald S Williamson, Yuxuan Wang, and DeLiang Wang, · 2016
Cited alongside, same era.
“Acoustic modelling from the signal domain using cnns.,”
Pegah Ghahremani, Vimal Manohar, Daniel Povey, and Sanjeev Khudanpur, · 2016
Cited alongside, same era.
“Wavenet: A generative model for raw audio,”
Aaron van den Oord, Sander Dieleman, Heiga Zen, Karen Simonyan, Oriol Vinyals, Alex Graves, Nal Kalchbrenner, Andrew Senior, and Koray Kavukcuoglu, · 2016
Cited alongside, same era.
“A guide to convolution arithmetic for deep learning,”
Vincent Dumoulin and Francesco Visin, · 2016
Later among the works it cites.
“Multitalker speech separation with utterance-level permutation invariant training of deep recurrent neural networks,”
Morten Kolbæk, Dong Yu, Zheng-Hua Tan, and Jesper Jensen, · 2017
Closest in time.
“Deep attractor network for single-microphone speaker separation,”
Zhuo Chen, Yi Luo, and Nima Mesgarani, · 2017
Closest in time.
“Deep clustering and conventional networks for music separation: Stronger together,”
Yi Luo, Zhuo Chen, John R Hershey, Jonathan Le Roux, and Nima Mesgarani, · 2017
Closest in time.
“Segan: Speech enhancement generative adversarial network,”
Santiago Pascual, Antonio Bonafonte, and Joan Serrà, · 2017
Closest in time.
alphaXiv searches the wider corpus for related work and actual follow-ups.
alphaXiv is searching for related work…
Soroush Mehri, Kundan Kumar, Ishaan Gulrajani, Rithesh Kumar, Shubham Jain, Jose Sotelo, Aaron Courville, and Yoshua Bengio, · 2016
Cited alongside, same era.
“Deep learning of part-based representation of data using sparse autoencoders with nonnegativity constraints,”
Ehsan Hosseini-Asl, Jacek M Zurada, and Olfa Nasraoui, · 2016
Cited alongside, same era.
Jimmy Lei Ba, Jamie Ryan Kiros, and Geoffrey E Hinton, · 2016
Cited alongside, same era.
“Identity mappings in deep residual networks,”
Kaiming He, Xiangyu Zhang, Shaoqing Ren, and Jian Sun, · 2016
Cited alongside, same era.
“Audio samples for TasNet,” http://naplab.ee.columbia.edu/tasnet.html
Cited in the paper.
Paris Smaragdis and Shrikant Venkataramani, · 2017
Closest in time.
“Language modeling with gated convolutional networks,”
Yann N Dauphin, Angela Fan, Michael Auli, and David Grangier, · 2017
Closest in time.
“Understanding the representation and computation of multilayer perceptrons: A case study in speech recognition,”
Tasha Nagamine and Nima Mesgarani, · 2017
Closest in time.
“Speaker-independent speech separation with deep attractor network,”
Yi Luo, Zhuo Chen, and Nima Mesgarani, · 2018
Closest in time.