The woman worked as a babysitter: On biases in language generation
Emily Sheng, Kai-Wei Chang, Premkumar Natarajan, and Nanyun Peng. 2019 · 2019
Cited alongside, same era.
Language (technology) is power: A critical survey of “bias” in NLP
Su Lin Blodgett, Solon Barocas, Hal Daumé III, and Hanna Wallach. 2020 · 2020
Cited alongside, same era.
RealToxicityPrompts: Evaluating neural toxic degeneration in language models
Samuel Gehman, Suchin Gururangan, Maarten Sap, Yejin Choi, and Noah A. Smith. 2020 · 2020
Cited alongside, same era.
Powertransformer: Unsupervised controllable revision for biased language correction
Original
Xinyao Ma, Maarten Sap, Hannah Rashkin, and Yejin Choi. 2020 · 2020
Cited alongside, same era.
Using sociolinguistic variables to reveal changing attitudes towards sexuality and gender
Sky CH-Wang and David Jurgens. 2021 · 2021
Cited alongside, same era.
Documenting large webtext corpora: A case study on the colossal clean crawled corpus
Jesse Dodge, Maarten Sap, Ana Marasović, William Agnew, Gabriel Ilharco, Dirk Groeneveld, Margaret Mitchell, and Matt Gardner. 2021 · 2021
Cited alongside, same era.
Unpacking the interdependent systems of discrimination: Ableist bias in NLP systems through an intersectional lens
Saad Hassan, Matt Huenerfauth, and Cecilia Ovesdotter Alm. 2021 · 2021
Cited alongside, same era.
Towards understanding and mitigating social biases in language models
Paul Pu Liang, Chiyu Wu, Louis-Philippe Morency, and Ruslan Salakhutdinov. 2021 · 2021
Cited alongside, same era.
Gender and representation bias in GPT-3 generated stories
Li Lucy and David Bamman. 2021 · 2021
Cited alongside, same era.
StereoSet: Measuring stereotypical bias in pretrained language models
Moin Nadeem, Anna Bethke, and Siva Reddy. 2021 · 2021
Cited alongside, same era.