Fetching the paper…
Reading the bibliography…
We introduce FaBERT, a Persian BERT-base model pre-trained on the HmBlogs corpus, encompassing both informal and formal Persian texts.
Roberta: A robustly optimized bert pretraining approach
Yinhan Liu, Myle Ott, Naman Goyal, Jingfei Du, Mandar Joshi, Danqi Chen, Omer Levy, Mike Lewis, Luke Zettlemoyer, and Veselin Stoyanov. 2019 · 1907
Earlier work this paper cites.
Unsupervised cross-lingual representation learning at scale
Alexis Conneau, Kartikay Khandelwal, Naman Goyal, Vishrav Chaudhary, Guillaume Wenzek, Francisco Guzmán, Edouard Grave, Myle Ott, Luke Zettlemoyer, and Veselin Stoyanov. 2019 · 1911
Earlier work this paper cites.
Deepsentipers: Novel deep learning models trained over proposed augmented persian sentiment corpus
Javad PourMostafa Roshan Sharami, Parsa Abbasi Sarabestani, and Seyed Abolghasem Mirroshandel. 2020 · 2004
Earlier work this paper cites.
Bert: Pre-training of deep bidirectional transformers for language understanding
Jacob Devlin, Ming-Wei Chang, Kenton Lee, and Kristina Toutanova. 2018 · 2018
Earlier work this paper cites.
Know what you don’t know: Unanswerable questions for squad
Pranav Rajpurkar, Robin Jia, and Percy Liang. 2018 · 2018
Earlier work this paper cites.
Peyma: A tagged corpus for persian named entities
Mahsa Sadat Shahshahani, Mahdi Mohseni, Azadeh Shakery, and Heshaam Faili. 2018 · 2018
Earlier work this paper cites.
Coqa: A conversational question answering challenge
Siva Reddy, Danqi Chen, and Christopher D Manning. 2019 · 2019
Earlier work this paper cites.
Optimizing annotation effort using active learning strategies: A sentiment analysis case study in persian
Seyed Arad Ashrafi Asli, Behnam Sabeti, Zahra Majdabadi, Preni Golazizian, Reza Fahmi, and Omid Momenzadeh. 2020 · 2020
Earlier work this paper cites.
Irony detection in persian language: A transfer learning approach using emoji prediction
Preni Golazizian, Behnam Sabeti, Seyed Arad Ashrafi Asli, Zahra Majdabadi, Omid Momenzadeh, and Reza Fahmi. 2020 · 2020
Cited alongside, same era.
Parstwiner: A corpus for named entity recognition at informal persian
MohammadMahdi Aghajani, AliAkbar Badri, and Hamid Beigy. 2021 · 2021
Cited alongside, same era.
Parsbert: Transformer-based model for persian language understanding
Mehrdad Farahani, Mohammad Gharachorloo, Marzieh Farahani, and Mohammad Manthouri. 2021 · 2021
Cited alongside, same era.
Hmblogs: A big general persian corpus
Hamzeh Motahari Khansari and Mehrnoush Shamsfard. 2021 · 2021
Cited alongside, same era.
Parsinlu: a suite of language understanding challenges for persian
Daniel Khashabi, Arman Cohan, Siamak Shakeri, Pedram Hosseini, Pouya Pezeshkpour, Malihe Alikhani, Moin Aminnaseri, Marzieh Bitaab, Faeze Brahman, Sarik Ghazarian, et al. 2021 · 2021
Cited alongside, same era.
Multiconer v2: a large multilingual dataset for fine-grained and noisy named entity recognition
Besnik Fetahu, Zhiyu Chen, Sudipta Kar, Oleg Rokhlenko, and Shervin Malmasi. 2023 · 2023
Later among the works it cites.
Cramming: Training a language model on a single gpu in one day
Jonas Geiping and Tom Goldstein. 2023 · 2023
Later among the works it cites.
Ariabert: A pre-trained persian bert model for natural language understanding
Arash Ghafouri, Mohammad Amin Abbasi, and Hassan Naderi. 2023 · 2023
Later among the works it cites.
Pcoqa: Persian conversational question answering dataset
Hamed Hematian Hemati, Atousa Toghyani, Atena Souri, Sayed Hesam Alavian, Hossein Sameti, and Hamid Beigy. 2023 · 2023
Later among the works it cites.
Harnessing the power of llms in practice: A survey on chatgpt and beyond
alphaXiv searches the wider corpus for related work and actual follow-ups.
alphaXiv is searching for related work…
Farstail: A persian natural language inference dataset
Hossein Amirkhani, Mohammad AzariJafari, Soroush Faridan-Jahromi, Zeinab Kouhkan, Zohreh Pourjafari, and Azadeh Amirak. 2023 · 2023
Cited alongside, same era.
Pquad: A persian question answering dataset
Kasra Darvishi, Newsha Shahbodaghkhan, Zahra Abbasiantaeb, and Saeedeh Momtazi. 2023 · 2023
Cited alongside, same era.
Jingfeng Yang, Hongye Jin, Ruixiang Tang, Xiaotian Han, Qizhang Feng, Haoming Jiang, Bing Yin, and Xia Hu. 2023 · 2023
Later among the works it cites.
The skipped beat: A study of sociopragmatic understanding in llms for 64 languages
Chiyu Zhang, Khai Duy Doan, Qisheng Liao, and Muhammad Abdul-Mageed. 2023 · 2023
Later among the works it cites.
A knowledge-based approach for recognizing textual entailments with a focus on causality and contradiction
Zeinab Rahimi and Mehrnoush ShamsFard. 2024 · 2024
Closest in time.