Fetching the paper…
Reading the bibliography…
The current gold standard for evaluating generated chest x-ray (CXR) reports is through radiologist annotations.
Mimic-cxr-jpg, a large publicly available database of labeled chest radiographs
Alistair E. W. Johnson, Tom J. Pollard, Nathaniel R. Greenbaum, Matthew P. Lungren, Chih ying Deng, Yifan Peng, Zhiyong Lu, Roger G. Mark, Seth J. Berkowitz, and Steven Horng · 1901
Earlier work this paper cites.
Bertscore: Evaluating text generation with bert
Tianyi Zhang, Felix Wu Varsha Kishore, Kilian Q. Weinberger, and Yoav Artzi · 1904
Earlier work this paper cites.
Bleu: a method for automatic evaluation of machine translation
Kishore Papineni, Salim Roukos, Todd Ward, and Wei-Jing Zhu · 2002
Earlier work this paper cites.
Combining automatic labelers and expert annotations for accurate radiology report labeling using BERT
Akshay Smit, Saahil Jain, Pranav Rajpurkar, Anuj Pareek, Andrew Ng, and Matthew Lungren · 2020
Earlier work this paper cites.
Retrieval-based chest x-ray report generation using a pre-trained contrastive language-image model
Mark Endo, Rayan Krishnan, Viswesh Krishna, Andrew Y. Ng, and Pranav Rajpurkar · 2021
Earlier work this paper cites.
Radgraph: Extracting clinical entities and relations from radiology reports
Saahil Jain, Ashwin Agrawal, Adriel Saporta, Steven QH Truong, Du Nguyen Duong, Tan Bui, Pierre Chambon, Yuhao Zhang, Matthew P. Lungren, Andrew Y. Ng, Curtis P. Langlotz, and Pranav Rajpurkar · 2021
Earlier work this paper cites.
Automated generation of accurate & fluent medical X-ray reports
Hoang Nguyen, Dong Nie, Taivanbat Badamdorj, Yujie Liu, Yingying Zhu, Jason Truong, and Li Cheng · 2021
Earlier work this paper cites.
Triage of persons with tuberculosis symptoms using artificial intelligence–based chest radiograph interpretation: A cost-effectiveness analysis
Ntwali Placide Nsengiyumva, Hamidah Hussain, Olivia Oxlade, Arman Majidulla, Ahsana Nazish, Dick Menzies Aamir J Khan, Faiz Ahmad Khan, and Kevin Schwartzman · 2021
Cited alongside, same era.
Improving chest x-ray report generation by leveraging warm starting
Aaron Nicolson, Jason Dowling, and Bevan Koopman · 2022
Cited alongside, same era.
Improving radiology report generation systems by removing hallucinated references to non-existent priors
Vignav Ramesh, Nathan A. Chi, and Pranav Rajpurkar · 2022
Cited alongside, same era.
A meta-evaluation of faithfulness metrics for long-form hospital-course summarization, 2023
Griffin Adams, Jason Zucker, and Noémie Elhadad · 2023
Cited alongside, same era.
Maira-1: A specialized large multimodal model for radiology report generation
Refisco: Report fix and score dataset for radiology report generation (version 0.0)
Katherine Tian, Sina J Hartung, Andrew A Li, Jaehwan Jeong, Fardad Behzadi, Juan Calle-Toro, Subathra Adithan, Michael Pohlen, David Osayande, and Pranav Rajpurkar · 2023
Later among the works it cites.
Towards generalist biomedical ai
Tao Tu, Shekoofeh Azizi, Danny Driess, Mike Schaekermann, Mohamed Amin, Pi-Chuan Chang, Andrew Carroll, Chuck Lau, Ryutaro Tanno, Ira Ktena, Basil Mustafa, Aakanksha Chowdhery, Yun Liu, Simon Kornblith, David Fleet, Philip Mansfield, Sushant Prakash, Renee Wong, Sunny Virmani, Christopher Semturs, S Sara Mahdavi, Bradley Green, Ewa Dominowska, Blaise Aguera y Arcas, Joelle Barral, Dale Webster, Greg S. Corrado, Yossi Matias, Karan Singhal, Pete Florence, Alan Karthikesalingam, and Vivek Natarajan · 2023
Later among the works it cites.
Enhancing medical text evaluation with gpt-4
Yiqing Xie, Sheng Zhang, Zelalem Gero Hao Cheng, Cliff Wong, Tristan Naumann, and Hoifung Poon · 2023
Later among the works it cites.
Evaluating progress in automatic chest x-ray radiology report generation
Feiyang Yu, Mark Endo, Rayan Krishnan, Ian Pan, Andy Tsai, Eduardo Pontes Reis, Eduardo Kaiser Ururahy Nunes Fonseca, Henrique Min Ho Lee, Zahra Shakeri Hossein Abad, Andrew Y. Ng, Curtis P. Langlotz, Vasantha Kumar Venugopal, and Pranav Rajpurkar · 2023
alphaXiv searches the wider corpus for related work and actual follow-ups.
alphaXiv is searching for related work…
Stephanie L. Hyland, Shruthi Bannur, Kenza Bouzid, Daniel C. Castro, Mercy Ranjit, Anton Schwaighofer, Fernando Pérez-García, Valentina Salvatelli, Shaury Srivastav, Anja Thieme, Noel Codella, Matthew P. Lungren, Maria Teodora Wetscherek, Ozan Oktay, and Javier Alvarez-Valle · 2023
Cited alongside, same era.
Multimodal image-text matching improves retrieval-based chest x-ray report generation
Jaehwan Jeong, Katherine Tian, Andrew Li, Sina Hartung, Subathra Adithan, Fardad Behzadi, Juan Calle, David Osayande, Michael Pohlen, and Pranav Rajpurkar · 2023
Cited alongside, same era.
G-eval: Nlg evaluation using gpt-4 with better human alignment
Yang Liu, Dan Iter, Yichong Xu, Shuohang Wang, Ruochen Xu, and Chenguang Zhu · 2023
Cited alongside, same era.
Later among the works it cites.
Leveraging professional radiologists’ expertise to enhance llms’ evaluation for radiology reports
Qingqing Zhu, Xiuying Chen, Qiao Jin, Benjamin Hou, Tejas Sudharshan Mathai, Pritam Mukherjee, Xin Gao, Ronald M. Summers, and Zhiyong Lu · 2023
Later among the works it cites.
Juan Manuel Zambrano Chaves, Shih-Cheng Huang, Yanbo Xu, Hanwen Xu, Naoto Usuyama, Sheng Zhang, Fei Wang, Yujia Xie, Mahmoud Khademi, Ziyi Yang, Hany Awadalla, Julia Gong, Houdong Hu, Jianwei Yang, Chunyuan Li, Jianfeng Gao, Yu Gu, Cliff Wong, Mu Wei, Tristan Naumann, Muhao Chen, Matthew P. Lungren, Serena Yeung-Levy, Curtis P. Langlotz, Sheng Wang, and Hoifung Poon · 2024
Closest in time.
Green: Generative radiology report evaluation and error notation, 2024
Sophie Ostmeier, Justin Xu, Zhihong Chen, Maya Varma, Louis Blankemeier, Christian Bluethgen, Arne Edward Michalson, Michael Moseley, Curtis Langlotz, Akshay S Chaudhari, and Jean-Benoit Delbrouck · 2024
Closest in time.