“Multi-task self-supervised learning for robust speech recognition,”
Mirco Ravanelli, Jianyuan Zhong, Santiago Pascual, Pawel Swietojanski, Joao Monteiro, Jan Trmal, and Yoshua Bengio, · 2020
Cited alongside, same era.
“A simple framework for contrastive learning of visual representations,”
Ting Chen, Simon Kornblith, Mohammad Norouzi, and Geoffrey Hinton, · 2020
Cited alongside, same era.
“Big transfer (bit): General visual representation learning,”
Alexander Kolesnikov, Lucas Beyer, Xiaohua Zhai, Joan Puigcerver, Jessica Yung, Sylvain Gelly, and Neil Houlsby, · 2020
Cited alongside, same era.
“Language models are few-shot learners,”
Tom B Brown, Benjamin Mann, Nick Ryder, Melanie Subbiah, Jared Kaplan, Prafulla Dhariwal, Arvind Neelakantan, Pranav Shyam, Girish Sastry, Amanda Askell, et al., · 2020
Cited alongside, same era.
“Self-supervised learning by cross-modal audio-video clustering,”
Humam Alwassel, Dhruv Mahajan, Bruno Korbar, Lorenzo Torresani, Bernard Ghanem, et al., · 2020
Cited alongside, same era.
“Uniter: Universal image-text representation learning,”
Yen-Chun Chen, Linjie Li, Licheng Yu, Ahmed El Kholy, Faisal Ahmed, Zhe Gan, Yu Cheng, and Jingjing Liu, · 2020
Cited alongside, same era.
“Bootstrap your own latent: A new approach to self-supervised learning,”
Jean-Bastien Grill, Florian Strub, Florent Altché, Corentin Tallec, Pierre H Richemond, Elena Buchatskaya, Carl Doersch, Bernardo Avila Pires, et al., · 2020
Cited alongside, same era.
“Vggsound: A large-scale audio-visual dataset,”
Honglie Chen, Weidi Xie, Andrea Vedaldi, and Andrew Zisserman, · 2020
Cited alongside, same era.
“Fsd50k: an open dataset of human-labeled sound events,”
Original
Eduardo Fonseca, Xavier Favory, Jordi Pons, Frederic Font, and Xavier Serra, · 2020
Cited alongside, same era.
“Clotho: An audio captioning dataset,”
Konstantinos Drossos, Samuel Lipping, and Tuomas Virtanen, · 2020
Cited alongside, same era.
“Contrastive learning of musical representations,”
Janne Spijkervet and John Ashley Burgoyne, · 2021
Cited alongside, same era.