Fetching the paper…
Reading the bibliography…
Large language models predominantly reflect Western cultures, largely due to the dominance of English-centric training data.
The dialogic emergence of culture
Dennis Tedlock and Bruce Mannheim. 1995 · 1995
Earlier work this paper cites.
Cultural awareness logs: A method for increasing international-mindedness among high school and middle school students
Michael Thier. 2013 · 2013
Earlier work this paper cites.
Determinants and effects of cultural context: A review, conceptual model, and propositions
Lalita A. Manrai, Ajay K. Manrai, Dana-Nicoleta Lascu, and Stefanie Friedeborn. 2019 · 2019
Earlier work this paper cites.
Parsquad: Machine translated squad dataset for persian question answering
Negin Abadani, Jamshid Mozafari, Afsaneh Fatemi, Mohammd Ali Nematbakhsh, and Arefeh Kazemi. 2021 · 2021
Earlier work this paper cites.
Translating Cultures: An Introduction for Translators, Interpreters and Mediators, Third Edition
David Katan and Mustapha Taibi. 2021 · 2021
Earlier work this paper cites.
ParsiNLU: A Suite of Language Understanding Challenges for Persian
Daniel Khashabi, Arman Cohan, Siamak Shakeri, Pedram Hosseini, Pouya Pezeshkpour, Malihe Alikhani, Moin Aminnaseri, Marzieh Bitaab, Faeze Brahman, Sarik Ghazarian, Mozhdeh Gheini, Arman Kabiri, Rabeeh Karimi Mahabagdi, Omid Memarrast, Ahmadreza Mosallanezhad, Erfan Noury, Shahab Raji, Mohammad Sadegh Rasooli, Sepideh Sadeghi, Erfan Sadeqi Azer, Niloofar Safi Samghabadi, Mahsa Shafaei, Saber Sheybani, Ali Tazarv, and Yadollah Yaghoobzadeh. 2021 · 2021
Earlier work this paper cites.
Pretrained language models are symbolic mathematics solvers too!
Kimia Noorbakhsh, Modar Sulaiman, Mahdi Sharifi, Kallol Roy, and Pooyan Jamshidi. 2021 · 2021
Earlier work this paper cites.
StoryDB: Broad multi-language narrative dataset
Alexey Tikhonov, Igor Samenko, and Ivan P. Yamshchikov. 2021 · 2021
Earlier work this paper cites.
Farstail: a persian natural language inference dataset
Hossein Amirkhani, Mohammad AzariJafari, Soroush Faridan-Jahromi, Zeinab Kouhkan, Zohreh Pourjafari, and Azadeh Amirak. 2023 · 2023
Earlier work this paper cites.
Pquad: A persian question answering dataset
Kasra Darvishi, Newsha Shahbodaghkhan, Zahra Abbasiantaeb, and Saeedeh Momtazi. 2023 · 2023
Earlier work this paper cites.
Reem I. Masoud, Ziquan Liu, Martin Ferianc, Philip Treleaven, and Miguel Rodrigues. 2023 · 2023
Earlier work this paper cites.
Gpqa: A graduate-level google-proof q&a benchmark
David Rein, Betty Li Hou, Asa Cooper Stickland, Jackson Petty, Richard Yuanzhe Pang, Julien Dirani, Julian Michael, and Samuel R. Bowman. 2023 · 2023
Earlier work this paper cites.
Challenging BIG-bench tasks and whether chain-of-thought can solve them
Mirac Suzgun, Nathan Scales, Nathanael Schärli, Sebastian Gehrmann, Yi Tay, Hyung Won Chung, Aakanksha Chowdhery, Quoc Le, Ed Chi, Denny Zhou, and Jason Wei. 2023 · 2023
Earlier work this paper cites.
Instruction-following evaluation for large language models
Jeffrey Zhou, Tianjian Lu, Swaroop Mishra, Siddhartha Brahma, Sujoy Basu, Yi Luan, Denny Zhou, and Le Hou. 2023 · 2023
Cited alongside, same era.
Benchmarking large language models for Persian: A preliminary study focusing on ChatGPT
Amirhossein Abaskohi, Sara Baruni, Mostafa Masoudi, Nesa Abbasi, Mohammad Hadi Babalou, Ali Edalat, Sepehr Kamahi, Samin Mahdizadeh Sani, Nikoo Naghavian, Danial Namazifard, Pouya Sadeghi, and Yadollah Yaghoobzadeh. 2024 · 2024
Cited alongside, same era.
Investigating cultural alignment of large language models
Badr AlKhamissi, Muhammad ElNokrashy, Mai Alkhamissi, and Mona Diab. 2024 · 2024
Cited alongside, same era.
Claude 3.5 sonnet model card addendum
Anthropic. 2024 · 2024
Cited alongside, same era.
Extrinsic evaluation of cultural competence in large language models
Shaily Bhatt and Fernando Diaz. 2024 · 2024
Blend: A benchmark for llms on everyday knowledge in diverse cultures and languages
Jun-Hee Myung, Nayeon Lee, Yi Zhou, Jiho Jin, Rifki Afina Putri, Dimosthenis Antypas, Hsuvas Borkakoty, Eunsu Kim, Carla Pérez-Almendros, Abinew Ali Ayele, V’ictor Guti’errez-Basulto, Yazm’in Ib’anez-Garc’ia, Hwaran Lee, Shamsuddeen Hassan Muhammad, Kiwoong Park, Anar Rzayev, Nina White, Seid Muhie Yimam, Mohammad Taher Pilehvar, Nedjma Djouhra Ousidhoum, José Camacho-Collados, and Alice Oh. 2024 · 2024
Later among the works it cites.
Having beer after prayer? measuring cultural bias in large language models
Tarek Naous, Michael Ryan, Alan Ritter, and Wei Xu. 2024 · 2024
Later among the works it cites.
PartAI/Dorna-Llama3-8B-Instruct
PartAI. 2024 · 2024
Later among the works it cites.
InFoBench: Evaluating instruction following ability in large language models
Yiwei Qin, Kaiqiang Song, Yebowen Hu, Wenlin Yao, Sangwoo Cho, Xiaoyang Wang, Xuansheng Wu, Fei Liu, Pengfei Liu, and Dong Yu. 2024 · 2024
Later among the works it cites.
Normad: A benchmark for measuring the cultural adaptability of large language models
alphaXiv searches the wider corpus for related work and actual follow-ups.
alphaXiv is searching for related work…
Cited alongside, same era.
A survey on evaluation of large language models
Yupeng Chang, Xu Wang, Jindong Wang, Yuan Wu, Linyi Yang, Kaijie Zhu, Hao Chen, Xiaoyuan Yi, Cunxiang Wang, Yidong Wang, Wei Ye, Yue Zhang, Yi Chang, Philip S. Yu, Qiang Yang, and Xing Xie. 2024 · 2024
Cited alongside, same era.
Yu Ying Chiu, Liwei Jiang, Bill Yuchen Lin, Chan Young Park, Shuyue Stella Li, Sahithya Ravi, Mehar Bhatia, Maria Antoniak, Yulia Tsvetkov, Vered Shwartz, and Yejin Choi. 2024 · 2024
Cited alongside, same era.
Abhimanyu Dubey, Abhinav Jauhri, Abhinav Pandey, Abhishek Kadian, Ahmad Al-Dahle, Aiesha Letman, Akhil Mathur, Alan Schelten, Amy Yang, Angela Fan, et al. 2024 · 2024
Cited alongside, same era.
Massively multi-cultural knowledge acquisition and lm benchmarking
Yi Fung, Ruining Zhao, Jae Doo, Chenkai Sun, and Heng Ji. 2024 · 2024
Cited alongside, same era.
Khayyam challenge (persianmmlu): Is your llm truly wise to the persian language?
Omid Ghahroodi, Marzia Nouri, Mohammad Vali Sanian, Alireza Sahebi, Doratossadat Dastgheib, Ehsaneddin Asgari, Mahdieh Soleymani Baghshah, and Mohammad Hossein Rohban. 2024 · 2024
Cited alongside, same era.
AceGPT, localizing large language models in Arabic
Huang Huang, Fei Yu, Jianqing Zhu, Xuening Sun, Hao Cheng, Song Dingjie, Zhihong Chen, Mosen Alharthi, Bang An, Juncai He, Ziche Liu, Junying Chen, Jianquan Li, Benyou Wang, Lian Zhang, Ruoyu Sun, Xiang Wan, Haizhou Li, and Jinchao Xu. 2024 · 2024
Cited alongside, same era.
CLIcK: A benchmark dataset of cultural and linguistic intelligence in Korean
Eunsu Kim, Juyoung Suk, Philhoon Oh, Haneul Yoo, James Thorne, and Alice Oh. 2024 · 2024
Cited alongside, same era.
Abhinav Rao, Akhila Yerukola, Vishwa Shah, Katharina Reinecke, and Maarten Sap. 2024 · 2024
Later among the works it cites.
Persianmind: A cross-lingual persian-english large language model
Pedram Rostami, Ali Salemi, and Mohammad Javad Dousti. 2024 · 2024
Later among the works it cites.
Psn: Persian social norms dataset for cross-cultural ai
Hamidreza Saffari, Mohammadamin Shafiei, and Francesco Pierri. 2024 · 2024
Later among the works it cites.
Translating across cultures: Llms for intralingual cultural adaptation
Pushpdeep Singh, Mayur Patidar, and Lovekesh Vig. 2024 · 2024
Later among the works it cites.
Musr: Testing the limits of chain-of-thought with multistep soft reasoning
Zayne Sprague, Xi Ye, Kaj Bostrom, Swarat Chaudhuri, and Greg Durrett. 2024 · 2024
Later among the works it cites.
Cultural bias and cultural alignment of large language models
Yan Tao, Olga Viberg, Ryan S Baker, and René F Kizilcec. 2024 · 2024
Later among the works it cites.
OpenAI Team. 2024 · 2024
Later among the works it cites.
How do large language models handle multilingualism?
Yiran Zhao, Wenxuan Zhang, Guizhen Chen, Kenji Kawaguchi, and Lidong Bing. 2024 · 2024
Later among the works it cites.