Fetching the paper…
Reading the bibliography…
Open-sourced large language models (LLMs) have demonstrated remarkable efficacy in various tasks with instruction tuning.
Bleu: a Method for Automatic Evaluation of Machine Translation
Papineni, K.; Roukos, S.; Ward, T.; and Zhu, W.-J. 2002 · 2002
Earlier work this paper cites.
chrF: character n-gram F-score for automatic MT evaluation
Popovic, M. 2015 · 2015
Earlier work this paper cites.
Bridging Neural Machine Translation and Bilingual Dictionaries
Zhang, J.; and Zong, C. 2016 · 2016
Earlier work this paper cites.
HABLex: Human Annotated Bilingual Lexicons for Experiments in Machine Translation
Thompson, B.; Knowles, R.; Zhang, X.; Khayrallah, H.; Duh, K.; and Koehn, P. 2019 · 2019
Earlier work this paper cites.
Language Models are Few-Shot Learners
Brown, T. B.; Mann, B.; Ryder, N.; Subbiah, M.; Kaplan, J.; Dhariwal, P.; Neelakantan, A.; Shyam, P.; Sastry, G.; Askell, A.; Agarwal, S.; Herbert-Voss, A.; Krueger, G.; Henighan, T.; Child, R.; Ramesh, A.; Ziegler, D. M.; Wu, J.; Winter, C.; Hesse, C.; Chen, M.; Sigler, E.; Litwin, M.; Gray, S.; Chess, B.; Clark, J.; Berner, C.; McCandlish, S.; Radford, A.; Sutskever, I.; and Amodei, D. 2020 · 2020
Earlier work this paper cites.
BLEURT: Learning Robust Metrics for Text Generation
Sellam, T.; Das, D.; and Parikh, A. 2020 · 2020
Earlier work this paper cites.
Learning to summarize with human feedback
Stiennon, N.; Ouyang, L.; Wu, J.; Ziegler, D. M.; Lowe, R.; Voss, C.; Radford, A.; Amodei, D.; and Christiano, P. F. 2020 · 2020
Earlier work this paper cites.
Are References Really Needed? Unbabel-IST 2021 Submission for the Metrics Shared Task
Rei, R.; Farinha, A. C.; Zerva, C.; van Stigt, D.; Stewart, C.; Ramos, P. G.; Glushkova, T.; Martins, A. F. T.; and Lavie, A. 2021 · 2021
Earlier work this paper cites.
Non-Parametric Unsupervised Domain Adaptation for Neural Machine Translation
Zheng, X.; Zhang, Z.; Huang, S.; Chen, B.; Xie, J.; Luo, W.; and Chen, J. 2021 · 2021
Earlier work this paper cites.
Detecting Hallucinated Content in Conditional Neural Sequence Generation
Zhou, C.; Neubig, G.; Gu, J.; Diab, M.; Guzmán, F.; Zettlemoyer, L.; and Ghazvininejad, M. 2021 · 2021
Earlier work this paper cites.
In-context Examples Selection for Machine Translation
Agrawal, S.; Zhou, C.; Lewis, M.; Zettlemoyer, L.; and Ghazvininejad, M. 2022 · 2022
Cited alongside, same era.
Scaling Instruction-Finetuned Language Models
Chung, H. W.; Hou, L.; Longpre, S.; Zoph, B.; Tay, Y.; Fedus, W.; Li, E.; Wang, X.; Dehghani, M.; Brahma, S.; Webson, A.; Gu, S. S.; Dai, Z.; Suzgun, M.; Chen, X.; Chowdhery, A.; Narang, S.; Mishra, G.; Yu, A.; Zhao, V. Y.; Huang, Y.; Dai, A. M.; Yu, H.; Petrov, S.; Chi, E. H.; Dean, J.; Devlin, J.; Roberts, A.; Zhou, D.; Le, Q. V.; and Wei, J. 2022 · 2022
Cited alongside, same era.
No Language Left Behind: Scaling Human-Centered Machine Translation
Costa-jussà, M. R.; Cross, J.; Çelebi, O.; Elbayad, M.; Heafield, K.; Heffernan, K.; Kalbassi, E.; Lam, J.; Licht, D.; Maillard, J.; Sun, A.; Wang, S.; Wenzek, G.; Youngblood, A.; Akula, B.; Barrault, L.; Gonzalez, G. M.; Hansanti, P.; Hoffman, J.; Jarrett, S.; Sadagopan, K. R.; Rowe, D.; Spruit, S.; Tran, C.; Andrews, P.; Ayan, N. F.; Bhosale, S.; Edunov, S.; Fan, A.; Gao, C.; Goswami, V.; Guzmán, F.; Koehn, P.; Mourachko, A.; Ropers, C.; Saleem, S.; Schwenk, H.; and Wang, J. 2022 · 2022
Cited alongside, same era.
Results of WMT22 Metrics Shared Task: Stop Using BLEU - Neural Metrics Are Better and More Robust
The unreasonable effectiveness of few-shot learning for machine translation
Garcia, X.; Bansal, Y.; Cherry, C.; Foster, G. F.; Krikun, M.; Feng, F.; Johnson, M.; and Firat, O. 2023 · 2023
Closest in time.
How Good Are GPT Models at Machine Translation? A Comprehensive Evaluation
Hendy, A.; Abdelrehim, M.; Sharaf, A.; Raunak, V.; Gabr, M.; Matsushita, H.; Kim, Y. J.; Afify, M.; and Awadalla, H. H. 2023 · 2023
Closest in time.
ParroT: Translating During Chat Using Large Language Models
Jiao, W.; Huang, J.; Wang, W.; Wang, X.; Shi, S.; and Tu, Z. 2023 · 2023
Closest in time.
Chain-of-Dictionary Prompting Elicits Translation in Large Language Models
Lu, H.; Huang, H.; Zhang, D.; Yang, H.; Lam, W.; and Wei, F. 2023 · 2023
Closest in time.
alphaXiv searches the wider corpus for related work and actual follow-ups.
alphaXiv is searching for related work…
Freitag, M.; Rei, R.; Mathur, N.; Lo, C.; Stewart, C.; Avramidis, E.; Kocmi, T.; Foster, G. F.; Lavie, A.; and Martins, A. F. T. 2022 · 2022
Cited alongside, same era.
LoRA: Low-Rank Adaptation of Large Language Models
Hu, E. J.; Shen, Y.; Wallis, P.; Allen-Zhu, Z.; Li, Y.; Wang, S.; Wang, L.; and Chen, W. 2022 · 2022
Cited alongside, same era.
Few-shot Learning with Multilingual Generative Language Models
Lin, X. V.; Mihaylov, T.; Artetxe, M.; Wang, T.; Chen, S.; Simig, D.; Ott, M.; Goyal, N.; Bhosale, S.; Du, J.; Pasunuru, R.; Shleifer, S.; Koura, P. S.; Chaudhary, V.; O’Horo, B.; Wang, J.; Zettlemoyer, L.; Kozareva, Z.; Diab, M. T.; Stoyanov, V.; and Li, X. 2022 · 2022
Cited alongside, same era.
Partial Could Be Better than Whole. HW-TSC 2022 Submission for the Metrics Shared Task
Liu, Y.; Qiao, X.; Wu, Z.; Su, C.; Zhang, M.; Zhao, Y.; Peng, S.; Tao, S.; Yang, H.; Qin, Y.; Guo, J.; Wang, M.; Li, Y.; Li, P.; and Zhao, X. 2022 · 2022
Cited alongside, same era.
Training language models to follow instructions with human feedback
Ouyang, L.; Wu, J.; Jiang, X.; Almeida, D.; Wainwright, C. L.; Mishkin, P.; Zhang, C.; Agarwal, S.; Slama, K.; Ray, A.; Schulman, J.; Hilton, J.; Kelton, F.; Miller, L.; Simens, M.; Askell, A.; Welinder, P.; Christiano, P. F.; Leike, J.; and Lowe, R. 2022 · 2022
Cited alongside, same era.
COMET-22: Unbabel-IST 2022 Submission for the Metrics Shared Task
Rei, R.; de Souza, J. G. C.; Alves, D. M.; Zerva, C.; Farinha, A. C.; Glushkova, T.; Lavie, A.; Coheur, L.; and Martins, A. F. T. 2022 · 2022
Cited alongside, same era.
UniTE: Unified Translation Evaluation
Wan, Y.; Liu, D.; Yang, B.; Zhang, H.; Chen, B.; Wong, D.; and Chao, L. 2022 · 2022
Cited alongside, same era.
LLaMA: Open and Efficient Foundation Language Models
Touvron, H.; Lavril, T.; Izacard, G.; Martinet, X.; Lachaux, M.; Lacroix, T.; Rozière, B.; Goyal, N.; Hambro, E.; Azhar, F.; Rodriguez, A.; Joulin, A.; Grave, E.; and Lample, G. 2023a
Cited in the paper.
Llama 2: Open Foundation and Fine-Tuned Chat Models
Touvron, H.; Martin, L.; Stone, K.; Albert, P.; Almahairi, A.; Babaei, Y.; Bashlykov, N.; Batra, S.; Bhargava, P.; Bhosale, S.; Bikel, D.; Blecher, L.; Canton-Ferrer, C.; Chen, M.; Cucurull, G.; Esiobu, D.; Fernandes, J.; Fu, J.; Fu, W.; Fuller, B.; Gao, C.; Goswami, V.; Goyal, N.; Hartshorn, A.; Hosseini, S.; Hou, R.; Inan, H.; Kardas, M.; Kerkez, V.; Khabsa, M.; Kloumann, I.; Korenev, A.; Koura, P. S.; Lachaux, M.; Lavril, T.; Lee, J.; Liskovich, D.; Lu, Y.; Mao, Y.; Martinet, X.; Mihaylov, T.; Mishra, P.; Molybog, I.; Nie, Y.; Poulton, A.; Reizenstein, J.; Rungta, R.; Saladi, K.; Schelten, A.; Silva, R.; Smith, E. M.; Subramanian, R.; Tan, X. E.; Tang, B.; Taylor, R.; Williams, A.; Kuan, J. X.; Xu, P.; Yan, Z.; Zarov, I.; Zhang, Y.; Fan, A.; Kambadur, M.; Narang, S.; Rodriguez, A.; Stojnic, R.; Edunov, S.; and Scialom, T. 2023b
Cited in the paper.
OpenAI. 2023 · 2023
Closest in time.
Direct Preference Optimization: Your Language Model is Secretly a Reward Model
Rafailov, R.; Sharma, A.; Mitchell, E.; Ermon, S.; Manning, C. D.; and Finn, C. 2023 · 2023
Closest in time.
Self-Instruct: Aligning Language Models with Self-Generated Instructions
Wang, Y.; Kordi, Y.; Mishra, S.; Liu, A.; Smith, N. A.; Khashabi, D.; and Hajishirzi, H. 2023 · 2023
Closest in time.
Zeng, J.; Meng, F.; Yin, Y.; and Zhou, J. 2023 · 2023
Closest in time.
Zhang, S.; Fang, Q.; Zhang, Z.; Ma, Z.; Zhou, Y.; Huang, L.; Bu, M.; Gui, S.; Chen, Y.; Chen, X.; and Feng, Y. 2023 · 2023
Closest in time.
Multilingual Machine Translation with Large Language Models: Empirical Results and Analysis
Zhu, W.; Liu, H.; Dong, Q.; Xu, J.; Kong, L.; Chen, J.; Li, L.; and Huang, S. 2023 · 2023
Closest in time.