Fetching the paper…
Reading the bibliography…
We introduce Universal NER (UNER), an open, community-driven project to develop gold-standard NER benchmarks in many languages.
Cross-lingual name tagging and linking for 282 languages
Xiaoman Pan, Boliang Zhang, Jonathan May, Joel Nothman, Kevin Knight, and Heng Ji. 2017 · 1958
Earlier work this paper cites.
Codes for the representation of names of languages—Part 2: alpha-3 code
International Organization for Standardization. 1998 · 1998
Earlier work this paper cites.
Language independent named entity recognition combining morphological and contextual evidence
Silviu Cucerzan and David Yarowsky. 1999 · 1999
Earlier work this paper cites.
Codes for the representation of names of languages—Part 1: Alpha-2 code
International Organization for Standardization. 2002 · 2002
Earlier work this paper cites.
Introduction to the CoNLL-2002 shared task: Language-independent named entity recognition
Erik F. Tjong Kim Sang. 2002 · 2002
Earlier work this paper cites.
Introduction to the CoNLL-2003 shared task: Language-independent named entity recognition
Erik F. Tjong Kim Sang and Fien De Meulder. 2003 · 2003
Earlier work this paper cites.
Named entity recognition for question answering
Diego Mollá, Menno van Zaanen, and Daniel Smith. 2006 · 2006
Earlier work this paper cites.
The impact of named entity normalization on information retrieval for question answering
Mahboob Alam Khalid, Valentin Jijkoun, and Maarten De Rijke. 2008 · 2008
Earlier work this paper cites.
UNER: Universal Named-Entity Recognition Framework
Diego Alves, Tin Kuculo, Gabriel Amaral, Gaurish Thakkar, and Marko Tadic. 2020 · 2010
Earlier work this paper cites.
Universal Dependency annotation for multilingual parsing
Ryan McDonald, Joakim Nivre, Yvonne Quirmbach-Brundage, Yoav Goldberg, Dipanjan Das, Kuzman Ganchev, Keith Hall, Slav Petrov, Hao Zhang, Oscar Täckström, Claudia Bedini, Núria Bertomeu Castelló, and Jungmee Lee. 2013 · 2013
Earlier work this paper cites.
Learning multilingual named entity recognition from Wikipedia
Joel Nothman, Nicky Ringland, Will Radford, Tara Murphy, and James R. Curran. 2013 · 2013
Earlier work this paper cites.
The SETimes.HR linguistically annotated corpus of Croatian
Željko Agić and Nikola Ljubešić. 2014 · 2014
Earlier work this paper cites.
A gold standard dependency corpus for English
Natalia Silveira, Timothy Dozat, Marie-Catherine de Marneffe, Samuel Bowman, Miriam Connor, John Bauer, and Chris Manning. 2014 · 2014
Earlier work this paper cites.
Universal Dependencies for Croatian (that work for Serbian, too)
Željko Agić and Nikola Ljubešić. 2015 · 2015
Earlier work this paper cites.
Universal Dependencies for Danish
Anders Johannsen, Héctor Martínez Alonso, and Barbara Plank. 2015 · 2015
Earlier work this paper cites.
Neural architectures for named entity recognition
Guillaume Lample, Miguel Ballesteros, Sandeep Subramanian, Kazuya Kawakami, and Chris Dyer. 2016 · 2016
Earlier work this paper cites.
New inflectional lexicons and training corpora for improved morphosyntactic annotation of Croatian and Serbian
Nikola Ljubešić, Filip Klubička, Željko Agić, and Ivo-Pavao Jazbec. 2016 · 2016
Earlier work this paper cites.
Universal Dependencies v1: A multilingual treebank collection
Joakim Nivre, Marie-Catherine de Marneffe, Filip Ginter, Yoav Goldberg, Jan Hajič, Christopher D. Manning, Ryan McDonald, Slav Petrov, Sampo Pyysalo, Natalia Silveira, Reut Tsarfaty, and Daniel Zeman. 2016 · 2016
Earlier work this paper cites.
UD_Chinese-GSD
Mo Shen, Ryan McDonald, Daniel Zeman, and Peng Qi. 2016 · 2016
Earlier work this paper cites.
LORELEI language packs: Data, tools, and resources for technology development in low resource languages
Stephanie Strassel and Jennifer Tracey. 2016 · 2016
Earlier work this paper cites.
Universal Dependencies for Portuguese
Alexandre Rademaker, Fabricio Chalub, Livy Real, Cláudia Freitas, Eckhard Bick, and Valeria de Paiva. 2017 · 2017
Earlier work this paper cites.
Universal Dependencies for Serbian in comparison with Croatian and other Slavic languages
Tanja Samardžić, Mirjana Starović, Željko Agić, and Nikola Ljubešić. 2017 · 2017
Cited alongside, same era.
Slovak dependency treebank in universal dependencies
Daniel Zeman. 2017 · 2017
Cited alongside, same era.
CoNLL 2017 shared task: Multilingual parsing from raw text to Universal Dependencies
Daniel Zeman, Martin Popel, Milan Straka, Jan Hajič, Joakim Nivre, Filip Ginter, Juhani Luotolahti, Sampo Pyysalo, Slav Petrov, Martin Potthast, Francis Tyers, Elena Badmaeva, Memduh Gokirmak, Anna Nedoluzhko, Silvie Cinková, Jan Hajič jr., Jaroslava Hlaváčová, Václava Kettnerová, Zdeňka Urešová, Jenna Kanerva, Stina Ojala, Anna Missilä, Christopher D. Manning, Sebastian Schuster, Siva Reddy, Dima Taji, Nizar Habash, Herman Leung, Marie-Catherine de Marneffe, Manuela Sanguinetti, Maria Simi, Hiroshi Kanayama, Valeria de Paiva, Kira Droganova, Héctor Martínez Alonso, Çağrı Çöltekin, Umut Sulubacak, Hans Uszkoreit, Vivien Macketanz, Aljoscha Burchardt, Kim Harris, Katrin Marheinecke, Georg Rehm, Tolga Kayadelen, Mohammed Attia, Ali Elkahky, Zhuoran Yu, Emily Pitler, Saran Lertpradit, Michael Mandl, Jesse Kirchner, Hector Fernandez Alcalde, Jana Strnadová, Esha Banerjee, Ruli Manurung, Antonio Stella, Atsuko Shimada, Sookyoung Kwak, Gustavo Mendonça, Tatiana Lando, Rattima Nitisaroj, and Josie Li. 2017 · 2017
Cited alongside, same era.
Setimes.SR—A Reference Training Corpus of Serbian
Vuk Batanović, Nikola Ljubešić, and Tanja Samardžić. 2018 · 2018
Cited alongside, same era.
Transformers: State-of-the-art natural language processing
Thomas Wolf, Lysandre Debut, Victor Sanh, Julien Chaumond, Clement Delangue, Anthony Moi, Pierric Cistac, Tim Rault, Remi Louf, Morgan Funtowicz, Joe Davison, Sam Shleifer, Patrick von Platen, Clara Ma, Yacine Jernite, Julien Plu, Canwen Xu, Teven Le Scao, Sylvain Gugger, Mariama Drame, Quentin Lhoest, and Alexander Rush. 2020 · 2020
Later among the works it cites.
Are all languages created equal in multilingual BERT?
Shijie Wu and Mark Dredze. 2020 · 2020
Later among the works it cites.
MasakhaNER: Named entity recognition for African languages
David Ifeoluwa Adelani, Jade Abbott, Graham Neubig, Daniel D’souza, Julia Kreutzer, Constantine Lignos, Chester Palen-Michel, Happy Buzaaba, Shruti Rijhwani, Sebastian Ruder, Stephen Mayhew, Israel Abebe Azime, Shamsuddeen H. Muhammad, Chris Chinenye Emezue, Joyce Nakatumba-Nabende, Perez Ogayo, Aremu Anuoluwapo, Catherine Gitau, Derguene Mbaye, Jesujoba Alabi, Seid Muhie Yimam, Tajuddeen Rabiu Gwadabe, Ignatius Ezeani, Rubungo Andre Niyongabo, Jonathan Mukiibi, Verrah Otiende, Iroro Orife, Davis David, Samba Ngom, Tosin Adewumi, Paul Rayson, Mofetoluwa Adeyemi, Gerald Muriuki, Emmanuel Anebi, Chiamaka Chukwuneke, Nkiruka Odu, Eric Peter Wairagala, Samuel Oyerinde, Clemencia Siro, Tobius Saul Bateesa, Temilola Oloyede, Yvonne Wambui, Victor Akinode, Deborah Nabagereka, Maurice Katusiime, Ayodele Awokoya, Mouhamadane MBOUP, Dibora Gebreyohannes, Henok Tilaye, Kelechi Nwaike, Degaga Wolde, Abdoulaye Faye, Blessing Sibanda, Orevaoghene Ahia, Bonaventure F. P. Dossou, Kelechi Ogueji, Thierno Ibrahima DIOP, Abdoulaye Diallo, Adewale Akinfaderin, Tendai Marengereke, and Salomey Osei. 2021 · 2021
Later among the works it cites.
alphaXiv searches the wider corpus for related work and actual follow-ups.
alphaXiv is searching for related work…
UniMorph 2.0: Universal Morphology
Christo Kirov, Ryan Cotterell, John Sylak-Glassman, Géraldine Walther, Ekaterina Vylomova, Patrick Xia, Manaal Faruqui, Sabrina J. Mielke, Arya McCarthy, Sandra Kübler, David Yarowsky, Jason Eisner, and Mans Hulden. 2018 · 2018
Cited alongside, same era.
TALEN: Tool for annotation of low-resource ENtities
Stephen Mayhew and Dan Roth. 2018 · 2018
Cited alongside, same era.
Low-resource sequence labeling via unsupervised multilingual contextualized representations
Zuyi Bao, Rui Huang, Chen Li, and Kenny Zhu. 2019 · 2019
Cited alongside, same era.
Twenty-five years of information extraction
Ralph Grishman. 2019 · 2019
Cited alongside, same era.
Neural cross-lingual transfer and limited annotated data for named entity recognition in Danish
Barbara Plank. 2019 · 2019
Cited alongside, same era.
UD_Chinese-GSDSimp
Peng Qi and Koichi Yasuoka. 2019 · 2019
Cited alongside, same era.
Unsupervised cross-lingual representation learning
Sebastian Ruder, Anders Søgaard, and Ivan Vulić. 2019 · 2019
Cited alongside, same era.
UD_Tagalog-Ugnayan
Angelina Aquino, Franz de Leon, and Mary Ann Bacolod. 2020 · 2020
Cited alongside, same era.
Khuyagbaatar Batsuren, Gábor Bella, and Fausto Giunchiglia. 2021 · 2021
Later among the works it cites.
Universal Dependencies
Marie-Catherine de Marneffe, Christopher D. Manning, Joakim Nivre, and Daniel Zeman. 2021 · 2021
Later among the works it cites.
Annotation guidelines of UD and SUD treebanks for spoken corpora: A proposal
Sylvain Kahane, Bernard Caron, Emmett Strickland, and Kim Gerdes. 2021 · 2021
Later among the works it cites.
Cross-lingual cross-domain nested named entity evaluation on English web texts
Barbara Plank. 2021 · 2021
Later among the works it cites.
WikiNEuRal: Combined neural and knowledge-based silver data creation for multilingual NER
Simone Tedeschi, Valentino Maiorca, Niccolò Campolungo, Francesco Cecconi, and Roberto Navigli. 2021 · 2021
Later among the works it cites.
MasakhaNER 2.0: Africa-centric transfer learning for named entity recognition
David Adelani, Graham Neubig, Sebastian Ruder, Shruti Rijhwani, Michael Beukman, Chester Palen-Michel, Constantine Lignos, Jesujoba Alabi, Shamsuddeen Muhammad, Peter Nabende, Cheikh M. Bamba Dione, Andiswa Bukula, Rooweither Mabuya, Bonaventure F. P. Dossou, Blessing Sibanda, Happy Buzaaba, Jonathan Mukiibi, Godson Kalipe, Derguene Mbaye, Amelia Taylor, Fatoumata Kabore, Chris Chinenye Emezue, Anuoluwapo Aremu, Perez Ogayo, Catherine Gitau, Edwin Munkoh-Buabeng, Victoire Memdjokam Koagne, Allahsera Auguste Tapo, Tebogo Macucwa, Vukosi Marivate, Mboning Tchiaze Elvis, Tajuddeen Gwadabe, Tosin Adewumi, Orevaoghene Ahia, Joyce Nakatumba-Nabende, Neo Lerato Mokono, Ignatius Ezeani, Chiamaka Chukwuneke, Mofetoluwa Oluwaseun Adeyemi, Gilles Quentin Hacheme, Idris Abdulmumin, Odunayo Ogundepo, Oreen Yousuf, Tatiana Moteu, and Dietrich Klakow. 2022 · 2022
Later among the works it cites.
The GJA Cebuano Treebank: Creating a Cebuano Universal Dependencies Treebank
Glyd Aranes. 2022 · 2022
Later among the works it cites.
UniMorph 4.0: Universal Morphology
Khuyagbaatar Batsuren, Omer Goldman, Salam Khalifa, Nizar Habash, Witold Kieraś, Gábor Bella, Brian Leonard, Garrett Nicolai, Kyle Gorman, Yustinus Ghanggo Ate, Maria Ryskina, Sabrina Mielke, Elena Budianskaya, Charbel El-Khaissi, Tiago Pimentel, Michael Gasser, William Abbott Lane, Mohit Raj, Matt Coler, Jaime Rafael Montoya Samame, Delio Siticonatzi Camaiteri, Esaú Zumaeta Rojas, Didier López Francis, Arturo Oncevay, Juan López Bautista, Gema Celeste Silva Villegas, Lucas Torroba Hennigen, Adam Ek, David Guriel, Peter Dirix, Jean-Philippe Bernardy, Andrey Scherbakov, Aziyana Bayyr-ool, Antonios Anastasopoulos, Roberto Zariquiey, Karina Sheifer, Sofya Ganieva, Hilaria Cruz, Ritván Karahóǧa, Stella Markantonatou, George Pavlidis, Matvey Plugaryov, Elena Klyachko, Ali Salehi, Candy Angulo, Jatayu Baxi, Andrew Krizhanovsky, Natalia Krizhanovskaya, Elizabeth Salesky, Clara Vania, Sardana Ivanova, Jennifer White, Rowan Hall Maudslay, Josef Valvoda, Ran Zmigrod, Paula Czarnowska, Irene Nikkarinen, Aelita Salchak, Brijesh Bhatt, Christopher Straughn, Zoey Liu, Jonathan North Washington, Yuval Pinter, Duygu Ataman, Marcin Wolinski, Totok Suhardijanto, Anna Yablonskaya, Niklas Stoehr, Hossep Dolatian, Zahroh Nuriah, Shyam Ratan, Francis M. Tyers, Edoardo M. Ponti, Grant Aiton, Aryaman Arora, Richard J. Hatcher, Ritesh Kumar, Jeremiah Young, Daria Rodionova, Anastasia Yemelina, Taras Andrushko, Igor Marchenko, Polina Mashkovtseva, Alexandra Serova, Emily Prud’hommeaux, Maria Nepomniashchaya, Fausto Giunchiglia, Eleanor Chodroff, Mans Hulden, Miikka Silfverberg, Arya D. McCarthy, David Yarowsky, Ryan Cotterell, Reut Tsarfaty, and Ekaterina Vylomova. 2022 · 2022
Later among the works it cites.
Toward more meaningful resources for lower-resourced languages
Constantine Lignos, Nolan Holley, Chester Palen-Michel, and Jonne Sälevä. 2022 · 2022
Later among the works it cites.
SemEval-2022 task 11: Multilingual complex named entity recognition (MultiCoNER)
Shervin Malmasi, Anjie Fang, Besnik Fetahu, Sudipta Kar, and Oleg Rokhlenko. 2022b · 2022
Later among the works it cites.
Frustratingly easy label projection for cross-lingual transfer
Yang Chen, Chao Jiang, Alan Ritter, and Wei Xu. 2023a · 2023
Closest in time.
CoLaDa: A collaborative label denoising framework for cross-lingual named entity recognition
Tingting Ma, Qianhui Wu, Huiqiang Jiang, Börje F. Karlsson, Tiejun Zhao, and Chin-Yew Lin. 2023 · 2023
Closest in time.
Crosslingual generalization through multitask finetuning
Niklas Muennighoff, Thomas Wang, Lintang Sutawika, Adam Roberts, Stella Biderman, Teven Le Scao, M Saiful Bari, Sheng Shen, Zheng Xin Yong, Hailey Schoelkopf, Xiangru Tang, Dragomir Radev, Alham Fikri Aji, Khalid Almubarak, Samuel Albanie, Zaid Alyafeai, Albert Webson, Edward Raff, and Colin Raffel. 2023 · 2023
Closest in time.
Named entity layer in Estonian UD treebanks
Kadri Muischnek and Kaili Müürisep. 2023 · 2023
Closest in time.
Enriching the NArabizi treebank: A multifaceted approach to supporting an under-resourced language
Arij Riabi, Menel Mahamdi, and Djamé Seddah. 2023 · 2023
Closest in time.
PARSEME corpus release 1.3
Agata Savary, Cherifa Ben Khelil, Carlos Ramisch, Voula Giouli, Verginica Barbu Mititelu, Najet Hadj Mohamed, Cvetana Krstev, Chaya Liebeskind, Hongzhi Xu, Sara Stymne, Tunga Güngör, Thomas Pickard, Bruno Guillaume, Eduard Bejček, Archna Bhatia, Marie Candito, Polona Gantar, Uxoa Iñurrieta, Albert Gatt, Jolanta Kovalevskaite, Timm Lichte, Nikola Ljubešić, Johanna Monti, Carla Parra Escartín, Mehrnoush Shamsfard, Ivelina Stoyanova, Veronika Vincze, and Abigail Walsh. 2023 · 2023
Closest in time.
UniversalNER: Targeted Distillation from Large Language Models for Open Named Entity Recognition
Wenxuan Zhou, Sheng Zhang, Yu Gu, Muhao Chen, and Hoifung Poon. 2023 · 2023
Closest in time.
A universal part-of-speech tagset
Slav Petrov, Dipanjan Das, and Ryan McDonald. 2012 · 2096
Closest in time.