Fetching the paper…
Reading the bibliography…
Hate speech and abusive language are global phenomena that need socio-cultural background knowledge to be understood, identified, and moderated.
Multilingual and multi-aspect hate speech analysis
Nedjma Ousidhoum, Zizheng Lin, Hongming Zhang, Yangqiu Song, and Dit-Yan Yeung. 2019 · 1908
Earlier work this paper cites.
Long Walk to Freedom: The Autobiography of Nelson Mandela
Nelson Mandela. 1994 · 1994
Earlier work this paper cites.
Free-marginal multirater kappa (multirater k [free]): An alternative to fleiss’ fixed-marginal multirater kappa
Justus J Randolph. 2005 · 2005
Earlier work this paper cites.
Migration, xenophobia and new racism in post-apartheid south africa
Carol Adjai and Gabriella Lazaridis. 2013 · 2013
Earlier work this paper cites.
Nature of tweets in the 2015 nigerian presidential elections
Nwachukwu Andrew Egbunike, Noel A. Ihebuzor, and Ngozi Joy Onyechi. 2015 · 2015
Earlier work this paper cites.
A lexicon-based approach for hate speech detection
Njagi Dennis Gitari, Zhang Zuping, Hanyurwimfura Damien, and Jun Long. 2015 · 2015
Earlier work this paper cites.
Hateful symbols or hateful people? predictive features for hate speech detection on twitter
Zeerak Talat and Dirk Hovy. 2016 · 2016
Earlier work this paper cites.
Automated hate speech detection and the problem of offensive language
Thomas Davidson, Dana Warmsley, Michael Macy, and Ingmar Weber. 2017 · 2017
Earlier work this paper cites.
Hate me, hate me not: Hate speech detection on facebook
Fabio Del Vigna, Andrea Cimino, Felice Dell’Orletta, Marinella Petrocchi, and Maurizio Tesconi. 2017 · 2017
Earlier work this paper cites.
Semeval-2019 task 5: Multilingual detection of hate speech against immigrants and women in twitter
Valerio Basile, Cristina Bosco, Elisabetta Fersini, Debora Nozza, Viviana Patti, Francisco Manuel Rangel Pardo, Paolo Rosso, and Manuela Sanguinetti. 2019 · 2019
Earlier work this paper cites.
A hierarchically-labeled portuguese hate speech dataset
Paula Fortuna, Joao Rocha da Silva, Leo Wanner, Sérgio Nunes, et al. 2019 · 2019
Earlier work this paper cites.
Spread of hate speech in online social media
Binny Mathew, Ritam Dutt, Pawan Goyal, and Animesh Mukherjee. 2019 · 2019
Earlier work this paper cites.
Hate speech detection in code-switched text messages
Edward Ombui, Lawrence Muchemi, and Peter Wagacha. 2019 · 2019
Earlier work this paper cites.
Prevalence and psychological effects of hateful speech in online college communities
Koustuv Saha, Eshwar Chandrasekharan, and Munmun De Choudhury. 2019 · 2019
Earlier work this paper cites.
Predicting the type and target of offensive posts in social media
Marcos Zampieri, Shervin Malmasi, Preslav Nakov, Sara Rosenthal, Noura Farra, and Ritesh Kumar. 2019 · 2019
Earlier work this paper cites.
Unsupervised cross-lingual representation learning at scale
Alexis Conneau, Kartikay Khandelwal, Naman Goyal, Vishrav Chaudhary, Guillaume Wenzek, Francisco Guzmán, Edouard Grave, Myle Ott, Luke Zettlemoyer, and Veselin Stoyanov. 2020 · 2020
Earlier work this paper cites.
Evaluating machine learning techniques for detecting offensive and hate speech in south african tweets
Oluwafemi Oriola and Eduan Kotzé. 2020 · 2020
Earlier work this paper cites.
Comparative evaluation of label-agnostic selection bias in multilingual hate speech datasets
Nedjma Ousidhoum, Yangqiu Song, and Dit-Yan Yeung. 2020 · 2020
Earlier work this paper cites.
MasakhaNER: Named Entity Recognition for African Languages
David Ifeoluwa Adelani, Jade Abbott, Graham Neubig, Daniel D’souza, Julia Kreutzer, Constantine Lignos, Chester Palen-Michel, Happy Buzaaba, Shruti Rijhwani, Sebastian Ruder, Stephen Mayhew, Israel Abebe Azime, Shamsuddeen H. Muhammad, Chris Chinenye Emezue, Joyce Nakatumba-Nabende, Perez Ogayo, Aremu Anuoluwapo, Catherine Gitau, Derguene Mbaye, Jesujoba Alabi, Seid Muhie Yimam, Tajuddeen Rabiu Gwadabe, Ignatius Ezeani, Rubungo Andre Niyongabo, Jonathan Mukiibi, Verrah Otiende, Iroro Orife, Davis David, Samba Ngom, Tosin Adewumi, Paul Rayson, Mofetoluwa Adeyemi, Gerald Muriuki, Emmanuel Anebi, Chiamaka Chukwuneke, Nkiruka Odu, Eric Peter Wairagala, Samuel Oyerinde, Clemencia Siro, Tobius Saul Bateesa, Temilola Oloyede, Yvonne Wambui, Victor Akinode, Deborah Nabagereka, Maurice Katusiime, Ayodele Awokoya, Mouhamadane MBOUP, Dibora Gebreyohannes, Henok Tilaye, Kelechi Nwaike, Degaga Wolde, Abdoulaye Faye, Blessing Sibanda, Orevaoghene Ahia, Bonaventure F. P. Dossou, Kelechi Ogueji, Thierno Ibrahima DIOP, Abdoulaye Diallo, Adewale Akinfaderin, Tendai Marengereke, and Salomey Osei. 2021 · 2021
Earlier work this paper cites.
Small data? no problem! exploring the viability of pretrained multilingual language models for low-resourced languages
Kelechi Ogueji, Yuxin Zhu, and Jimmy Lin. 2021 · 2021
Earlier work this paper cites.
Learning from the worst: Dynamically generated datasets to improve online hate detection
Bertie Vidgen, Tristan Thrush, Zeerak Waseem, and Douwe Kiela. 2021 · 2021
Cited alongside, same era.
Towards generalisable hate speech detection: a review on obstacles and solutions
Wenjie Yin and Arkaitz Zubiaga. 2021 · 2021
Cited alongside, same era.
Afaan oromo hate speech detection and classification on social media
Teshome Mulugeta Ababu and Michael Melese Woldeyohannis. 2022 · 2022
Cited alongside, same era.
Adapting pre-trained language models to African languages via multilingual adaptive fine-tuning
Jesujoba O. Alabi, David Ifeoluwa Adelani, Marius Mosbach, and Dietrich Klakow. 2022 · 2022
Cited alongside, same era.
Herdphobia: a dataset for hate speech against fulani in nigeria
Saminu Mohammad Aliyu, Gregory Maksha Wajiga, Muhammad Murtala, Shamsuddeen Hassan Muhammad, Idris Abdulmumin, and Ibrahim Said Ahmad. 2022 · 2022
Cited alongside, same era.
Twitter hate speech detection: A systematic review of methods, taxonomy analysis, challenges, and opportunities
Zainab Mansur, Nazlia Omar, and Sabrina Tiun. 2023 · 2023
Later among the works it cites.
Crosslingual generalization through multitask finetuning
Niklas Muennighoff, Thomas Wang, Lintang Sutawika, Adam Roberts, Stella Biderman, Teven Le Scao, M Saiful Bari, Sheng Shen, Zheng Xin Yong, Hailey Schoelkopf, Xiangru Tang, Dragomir Radev, Alham Fikri Aji, Khalid Almubarak, Samuel Albanie, Zaid Alyafeai, Albert Webson, Edward Raff, and Colin Raffel. 2023 · 2023
Later among the works it cites.
Afrisenti: A twitter sentiment analysis benchmark for african languages
Shamsuddeen Hassan Muhammad, Idris Abdulmumin, Abinew Ali Ayele, Nedjma Ousidhoum, David Ifeoluwa Adelani, Seid Muhie Yimam, Ibrahim Said Ahmad, Meriem Beloucif, Saif M Mohammad, Sebastian Ruder, et al. 2023 · 2023
Later among the works it cites.
Detection of hate speech code mix involving english and other nigerian languages
Joseph Nda Ndabula, Oyenike Mary Olanrewaju, and Faith O Echobu. 2023 · 2023
Later among the works it cites.
Better quality pre-training data and t5 models for African languages
Akintunde Oladipo, Mofetoluwa Adeyemi, Orevaoghene Ahia, Abraham Owodunni, Odunayo Ogundepo, David Adelani, and Jimmy Lin. 2023 · 2023
alphaXiv searches the wider corpus for related work and actual follow-ups.
alphaXiv is searching for related work…
The 5js in ethiopia: Amharic hate speech data annotation using toloka crowdsourcing platform
Abinew Ali Ayele, Skadi Dinter, Tadesse Destaw Belay, Tesfa Tegegne Asfaw, Seid Muhie Yimam, and Chris Biemann. 2022 · 2022
Cited alongside, same era.
Language-agnostic bert sentence embedding
Fangxiaoyu Feng, Yinfei Yang, Daniel Cer, Naveen Arivazhagan, and Wei Wang. 2022 · 2022
Cited alongside, same era.
Listening to affected communities to define extreme speech: Dataset and experiments
Antonis Maronikolakis, Axel Wisiorek, Leah Nann, Haris Jabbar, Sahana Udupa, and Hinrich Schütze. 2022 · 2022
Cited alongside, same era.
Naijasenti: A nigerian twitter sentiment corpus for multilingual sentiment analysis
Shamsuddeen Hassan Muhammad, David Ifeoluwa Adelani, Sebastian Ruder, Ibrahim Said Ahmad, Idris Abdulmumin, Bello Shehu Bello, Monojit Choudhury, Chris Chinenye Emezue, Saheed Salahudeen Abdullahi, Anuoluwapo Aremu, Alipio Jeorge, and Pavel Brazdil. 2022 · 2022
Cited alongside, same era.
Multilingual HateCheck: Functional tests for multilingual hate speech detection models
Paul Röttger, Haitham Seelawi, Debora Nozza, Zeerak Talat, and Bertie Vidgen. 2022 · 2022
Cited alongside, same era.
Bloom: A 176b-parameter open-access multilingual language model
Teven Le Scao, Angela Fan, Christopher Akiki, Ellie Pavlick, Suzana Ili’c, Daniel Hesslow, Roman Castagn’e, Alexandra Sasha Luccioni, François Yvon, Matthias Gallé, Jonathan Tow, Alexander M. Rush, Stella Biderman, Albert Webson, Pawan Sasanka Ammanamanchi, Thomas Wang, Benoît Sagot, Niklas Muennighoff, Albert Villanova del Moral, Olatunji Ruwase, Rachel Bawden, Stas Bekman, Angelina McMillan-Major, Iz Beltagy, Huu Nguyen, Lucile Saulnier, Samson Tan, Pedro Ortiz Suarez, Victor Sanh, Hugo Laurenccon, Yacine Jernite, Julien Launay, Margaret Mitchell, Colin Raffel, Aaron Gokaslan, Adi Simhi, Aitor Soroa Etxabe, Alham Fikri Aji, Amit Alfassy, Anna Rogers, Ariel Kreisberg Nitzav, Canwen Xu, Chenghao Mou, Chris C. Emezue, Christopher Klamm, Colin Leong, Daniel Alexander van Strien, David Ifeoluwa Adelani, Dragomir R. Radev, Eduardo Gonz’alez Ponferrada, and et al. 2022 · 2022
Cited alongside, same era.
Efficient few-shot learning without prompts
Lewis Tunstall, Nils Reimers, Unso Eun Seo Jo, Luke Bates, Daniel Korat, Moshe Wasserblat, and Oren Pereg. 2022 · 2022
Cited alongside, same era.
Later among the works it cites.
The intended uses of automated fact-checking artefacts: Why, how and who
Michael Schlichtkrull, Nedjma Ousidhoum, and Andreas Vlachos. 2023 · 2023
Later among the works it cites.
Decolonizing content moderation: Does uniform global community standard resemble utopian equality or western power hegemony?
Farhana Shahid and Aditya Vashistha. 2023 · 2023
Later among the works it cites.
Correcting flores evaluation dataset for four african languages
Idris Abdulmumin, Sthembiso Mkhwanazi, Mahlatse S Mbooi, Shamsuddeen Hassan Muhammad, Ibrahim Said Ahmad, Neo Putini, Miehleketo Mathebula, Matimba Shingange, Tajuddeen Gwadabe, and Vukosi Marivate. 2024 · 2024
Later among the works it cites.
SIB-200: A simple, inclusive, and big evaluation dataset for topic classification in 200+ languages and dialects
David Adelani, Hannah Liu, Xiaoyu Shen, Nikita Vassilyev, Jesujoba Alabi, Yanke Mao, Haonan Gao, and En-Shiun Lee. 2024 · 2024
Later among the works it cites.
Aya 23: Open weight releases to further multilingual progress
Viraat Aryabumi, John Dang, Dwarak Talupuru, Saurabh Dash, David Cairuz, Hangyu Lin, Bharat Venkitesh, Madeline Smith, Kelly Marchisio, Sebastian Ruder, Acyr F. Locatelli, Julia Kreutzer, Nick Frosst, Phil Blunsom, Marzieh Fadaee, A. Ustun, and Sara Hooker. 2024 · 2024
Later among the works it cites.
Abinew Ali Ayele, Esubalew Alemneh Jalew, Adem Chanie Ali, Seid Muhie Yimam, and Christian Biemann. 2024 · 2024
Later among the works it cites.
Abhimanyu Dubey, Abhinav Jauhri, Abhinav Pandey, Abhishek Kadian, Ahmad Al-Dahle, Aiesha Letman, Akhil Mathur, Alan Schelten, Amy Yang, Angela Fan, Anirudh Goyal, Anthony Hartshorn, Aobo Yang, Archi Mitra, Archie Sravankumar, Artem Korenev, Arthur Hinsvark, Arun Rao, Aston Zhang, Aurelien Rodriguez, and et al. 2024 · 2024
Later among the works it cites.
Comfort Eseohen Ilevbare, Jesujoba O Alabi, David Ifeoluwa Adelani, Firdous Damilola Bakare, Oluwatoyin Bunmi Abiola, and Oluwaseyi Adesina Adeyemo. 2024 · 2024
Later among the works it cites.
Exploring cross-cultural differences in English hate speech annotations: From dataset construction to analysis
Nayeon Lee, Chani Jung, Junho Myung, Jiho Jin, Jose Camacho-Collados, Juho Kim, and Alice Oh. 2024 · 2024
Later among the works it cites.
The role of social media in xenophobic attack in south africa
Mpho Raborife, Blessing Ogechi Ogbuokiri, and Kehinde D. Aruleba. 2024 · 2024
Later among the works it cites.
Politicization of hate and weaponization of twitter/x in a polarized digital space in nigeria
Abdulhameed Olaitan Ridwanullah, Sulaiman Ya’u Sule, Bashiru Usman, and Lauratu Umar Abdulsalam. 2024 · 2024
Later among the works it cites.
Gemma 2: Improving open language models at a practical size
Gemma Team, Morgane Riviere, Shreya Pathak, Pier Giuseppe Sessa, Cassidy Hardin, Surya Bhupatiraju, L’eonard Hussenot, Thomas Mesnard, Bobak Shahriari, Alexandre Ram’e, Johan Ferret, Peter Liu, Pouya Dehghani Tafti, Abe Friesen, Michelle Casbon, Sabela Ramos, Ravin Kumar, Charline Le Lan, Sammy Jerome, and et al. 2024 · 2024
Later among the works it cites.
Inkubalm: A small language model for low-resource african languages
Atnafu Lambebo Tonja, Bonaventure F. P. Dossou, Jessica Ojo, Jenalea Rajab, Fadel Thior, Eric Peter Wairagala, Aremu Anuoluwapo, Pelonomi Moiloa, Jade Abbott, Vukosi Marivate, and Benjamin Rosman. 2024 · 2024
Later among the works it cites.
NaijaHate: Evaluating hate speech detection on Nigerian Twitter using representative data
Manuel Tonneau, Pedro Quinta De Castro, Karim Lasri, Ibrahim Farouq, Lakshmi Subramanian, Victor Orozco-Olvera, and Samuel Fraiberger. 2024 · 2024
Later among the works it cites.
Hausahate: an expert annotated corpus for hausa hate speech detection
Francielle Alves Vargas, Samuel Guimarães, Shamsuddeen Hassan Muhammad, Diego Alves, Ibrahim Said Ahmad, Idris Abdulmumin, Diallo Mohamed, Thiago Alexandre Salgueiro Pardo, and Fabrício Benevenuto. 2024 · 2024
Later among the works it cites.