Fetching the paper…
Reading the bibliography…
Radiology report generation (RRG) aims to automatically produce diagnostic reports from medical images, with the potential to enhance clinical workflows and reduce radiologists' workload.
Bleu: a method for automatic evaluation of machine translation
Kishore Papineni, Salim Roukos, Todd Ward, and Wei-Jing Zhu · 2002
Earlier work this paper cites.
Rouge: A package for automatic evaluation of summaries
Chin-Yew Lin · 2004
Earlier work this paper cites.
Accuracy of radiographic readings in the emergency department
Bruno Petinaux, Rahul Bhat, Keith Boniface, and Jaime Aristizabal · 2011
Earlier work this paper cites.
The effects of changes in utilization and technological advancements of cross-sectional imaging on radiologist workload
Robert J McDonald, Kara M Schwartz, Laurence J Eckel, Felix E Diehn, Christopher H Hunt, Brian J Bartholmai, Bradley J Erickson, and David F Kallmes · 2015
Earlier work this paper cites.
Preparing a collection of radiology examinations for distribution and retrieval
Dina Demner-Fushman, Marc D Kohli, Marc B Rosenman, Sonya E Shooshan, Laritza Rodriguez, Sameer Antani, George R Thoma, and Clement J McDonald · 2016
Earlier work this paper cites.
Mimic-cxr-jpg, a large publicly available database of labeled chest radiographs
Alistair EW Johnson, Tom J Pollard, Nathaniel R Greenbaum, Matthew P Lungren, Chih-ying Deng, Yifan Peng, Zhiyong Lu, Roger G Mark, Seth J Berkowitz, and Steven Horng · 2019
Earlier work this paper cites.
Bertscore: Evaluating text generation with bert
Tianyi Zhang, Varsha Kishore, Felix Wu, Kilian Q Weinberger, and Yoav Artzi · 2019
Earlier work this paper cites.
What makes multi-modal learning better than single (provably)
Yu Huang, Chenzhuang Du, Zihui Xue, Xuanyao Chen, Hang Zhao, and Longbo Huang · 2021
Earlier work this paper cites.
Swin transformer: Hierarchical vision transformer using shifted windows
Ze Liu, Yutong Lin, Yue Cao, Han Hu, Yixuan Wei, Zheng Zhang, Stephen Lin, and Baining Guo · 2021
Earlier work this paper cites.
Learning transferable visual models from natural language supervision
Alec Radford, Jong Wook Kim, Chris Hallacy, Aditya Ramesh, Gabriel Goh, Sandhini Agarwal, Girish Sastry, Amanda Askell, Pamela Mishkin, Jack Clark, et al · 2021
Earlier work this paper cites.
Medclip: Contrastive learning from unpaired medical images and text
Zifeng Wang, Zhenbang Wu, Dinesh Agarwal, and Jimeng Sun · 2022
Earlier work this paper cites.
Josh Achiam, Steven Adler, Sandhini Agarwal, Lama Ahmad, Ilge Akkaya, Florencia Leoni Aleman, Diogo Almeida, Janko Altenschmidt, Sam Altman, Shyamal Anadkat, et al · 2023
Earlier work this paper cites.
DALL-E3, 2023
OpenAI · 2023
Earlier work this paper cites.
Blip-2: Bootstrapping language-image pre-training with frozen image encoders and large language models
Junnan Li, Dongxu Li, Silvio Savarese, and Steven Hoi · 2023
Earlier work this paper cites.
Sparkles: Unlocking chats across multiple images for multimodal instruction-following models
Yupan Huang, Zaiqiao Meng, Fangyu Liu, Yixuan Su, Nigel Collier, and Yutong Lu · 2023
Earlier work this paper cites.
Llava-med: Training a large language-and-vision assistant for biomedicine in one day
Chunyuan Li, Cliff Wong, Sheng Zhang, Naoto Usuyama, Haotian Liu, Jianwei Yang, Tristan Naumann, Hoifung Poon, and Jianfeng Gao · 2023
Earlier work this paper cites.
Chemical language models for de novo drug design: Challenges and opportunities
Francesca Grisoni · 2023
Earlier work this paper cites.
Using chatgpt to write patient clinic letters
Stephen R Ali, Thomas D Dobbs, Hayley A Hutchings, and Iain S Whitaker · 2023
Earlier work this paper cites.
Radiology-llama2: Best-in-class large language model for radiology
Zhengliang Liu, Yiwei Li, Peng Shu, Aoxiao Zhong, Longtao Yang, Chao Ju, Zihao Wu, Chong Ma, Jie Luo, Cheng Chen, et al · 2023
Earlier work this paper cites.
Generation of radiology findings in chest x-ray by leveraging collaborative knowledge
Manuela Daniela Danu, George Marica, Sanjeev Kumar Karn, Bogdan Georgescu, Awais Mansoor, Florin Ghesu, Lucian Mihai Itu, Constantin Suciu, Sasa Grbic, Oladimeji Farri, et al · 2023
Earlier work this paper cites.
Retrieval-augmented generation for large language models: A survey
Yunfan Gao, Yun Xiong, Xinyu Gao, Kangxiang Jia, Jinliu Pan, Yuxi Bi, Yixin Dai, Jiawei Sun, Haofen Wang, and Haofen Wang · 2023
Earlier work this paper cites.
Ramm: Retrieval-augmented biomedical visual question answering with multi-modal pre-training
Zheng Yuan, Qiao Jin, Chuanqi Tan, Zhengyun Zhao, Hongyi Yuan, Fei Huang, and Songfang Huang · 2023
Earlier work this paper cites.
Effectively fine-tune to improve large multimodal models for radiology report generation
Yuzhe Lu, Sungmin Hong, Yash Shah, and Panpan Xu · 2023
Cited alongside, same era.
R2gengpt: Radiology report generation with frozen llms
Zhanyu Wang, Lingqiao Liu, Lei Wang, and Luping Zhou · 2023
Cited alongside, same era.
Xraygpt: Chest radiographs summarization using medical vision-language models
Omkar Thawkar, Abdelrahman Shaker, Sahal Shaji Mullappilly, Hisham Cholakkal, Rao Muhammad Anwer, Salman Khan, Jorma Laaksonen, and Fahad Shahbaz Khan · 2023
Cited alongside, same era.
Maira-1: A specialised large multimodal model for radiology report generation
Stephanie L Hyland, Shruthi Bannur, Kenza Bouzid, Daniel C Castro, Mercy Ranjit, Anton Schwaighofer, Fernando Pérez-García, Valentina Salvatelli, Shaury Srivastav, Anja Thieme, et al · 2023
Cited alongside, same era.
Large model driven radiology report generation with clinical quality reinforcement learning
Zijian Zhou, Miaojing Shi, Meng Wei, Oluwatosin Alabi, Zijie Yue, and Tom Vercauteren · 2024
Later among the works it cites.
Cares: A comprehensive benchmark of trustworthiness in medical vision language models
Peng Xia, Ze Chen, Juanxi Tian, Yangrui Gong, Ruibo Hou, Yue Xu, Zhenbang Wu, Zhiyuan Fan, Yiyang Zhou, Kangyu Zhu, et al · 2024
Later among the works it cites.
Conflictbank: A benchmark for evaluating the influence of knowledge conflicts in llm
Zhaochen Su, Jun Zhang, Xiaoye Qu, Tong Zhu, Yanshu Li, Jiashuo Sun, Juntao Li, Min Zhang, and Yu Cheng · 2024
Later among the works it cites.
A survey on hallucination in large vision-language models
Hanchao Liu, Wenyuan Xue, Yifei Chen, Dapeng Chen, Xiutian Zhao, Ke Wang, Liping Hou, Rongjun Li, and Wei Peng · 2024
Later among the works it cites.
alphaXiv searches the wider corpus for related work and actual follow-ups.
alphaXiv is searching for related work…
Wei-Lin Chiang, Zhuohan Li, Zi Lin, Ying Sheng, Zhanghao Wu, Hao Zhang, Lianmin Zheng, Siyuan Zhuang, Yonghao Zhuang, Joseph E Gonzalez, et al · 2023
Cited alongside, same era.
Investigating the catastrophic forgetting in multimodal large language models
Yuexiang Zhai, Shengbang Tong, Xiao Li, Mu Cai, Qing Qu, Yong Jae Lee, and Yi Ma · 2023
Cited alongside, same era.
The importance of robust features in mitigating catastrophic forgetting
Hikmat Khan, Nidhal C Bouaynaya, and Ghulam Rasool · 2023
Cited alongside, same era.
Retrieval augmented chest x-ray report generation using openai gpt models
Mercy Ranjit, Gopinath Ganapathy, Ranjit Manuel, and Tanuja Ganu · 2023
Cited alongside, same era.
Medagents: Large language models as collaborators for zero-shot medical reasoning
Xiangru Tang, Anni Zou, Zhuosheng Zhang, Ziming Li, Yilun Zhao, Xingyao Zhang, Arman Cohan, and Mark Gerstein · 2023
Cited alongside, same era.
Are we going mad? benchmarking multi-agent debate between language models for medical q&a
Andries Petrus Smit, Paul Duckworth, Nathan Grinsztajn, Kale-ab Tessera, Thomas D Barrett, and Arnu Pretorius · 2023
Cited alongside, same era.
Judging llm-as-a-judge with mt-bench and chatbot arena
Lianmin Zheng, Wei-Lin Chiang, Ying Sheng, Siyuan Zhuang, Zhanghao Wu, Yonghao Zhuang, Zi Lin, Zhuohan Li, Dacheng Li, Eric Xing, et al · 2023
Cited alongside, same era.
Multimodal healthcare ai: identifying and designing clinically relevant vision-language applications for radiology
Nur Yildirim, Hannah Richardson, Maria Teodora Wetscherek, Junaid Bajwa, Joseph Jacob, Mark Ames Pinnock, Stephen Harris, Daniel Coelho De Castro, Shruthi Bannur, Stephanie Hyland, et al · 2024
Cited alongside, same era.
Jiashuo Sun, Jihai Zhang, Yucheng Zhou, Zhaochen Su, Xiaoye Qu, and Yu Cheng · 2024
Later among the works it cites.
Fact-aware multimodal retrieval augmentation for accurate medical radiology report generation
Liwen Sun, James Zhao, Megan Han, and Chenyan Xiong · 2024
Later among the works it cites.
Mmed-rag: Versatile multimodal rag system for medical vision language models
Peng Xia, Kangyu Zhu, Haoran Li, Tianze Wang, Weijia Shi, Sheng Wang, Linjun Zhang, James Zou, and Huaxiu Yao · 2024
Later among the works it cites.
Optimizing relation extraction in medical texts through active learning: A comparative analysis of trade-offs
Siting Liang, Pablo Sánchez, and Daniel Sonntag · 2024
Later among the works it cites.
Report generation from x-ray imaging by retrieval-augmented generation and improved image-text matching
Mario Luca Bernardi and Marta Cimitile · 2024
Later among the works it cites.
Rule: Reliable multimodal rag for factuality in medical vision language models
Peng Xia, Kangyu Zhu, Haoran Li, Hongtu Zhu, Yun Li, Gang Li, Linjun Zhang, and Huaxiu Yao · 2024
Later among the works it cites.
A survey on large language model based autonomous agents
Lei Wang, Chen Ma, Xueyang Feng, Zeyu Zhang, Hao Yang, Jingsen Zhang, Zhiyuan Chen, Jiakai Tang, Xu Chen, Yankai Lin, et al · 2024
Later among the works it cites.
Ct-agent: Clinical trial multi-agent with large language model-based reasoning
Ling Yue and Tianfan Fu · 2024
Later among the works it cites.
Yu He Ke, Rui Yang, Sui An Lie, Taylor Xin Yi Lim, Hairil Rizal Abdullah, Daniel Shu Wei Ting, and Nan Liu · 2024
Later among the works it cites.
Medco: Medical education copilots based on a multi-agent framework
Hao Wei, Jianing Qiu, Haibao Yu, and Wu Yuan · 2024
Later among the works it cites.
Enhancing llms for impression generation in radiology reports through a multi-agent system
Fang Zeng, Zhiliang Lyu, Quanzheng Li, and Xiang Li · 2024
Later among the works it cites.
Factual serialization enhancement: A key innovation for chest x-ray report generation
Kang Liu, Zhuoqi Ma, Mengmeng Liu, Zhicheng Jiao, Xiaolu Kang, Qiguang Miao, and Kun Xie · 2024
Later among the works it cites.
Claude 3 haiku: Our fastest model yet, 2024
Anthropic · 2024
Later among the works it cites.
A survey on multimodal large language models in radiology for report generation and visual question answering
Ziruo Yi, Ting Xiao, and Mark V Albert · 2025
Closest in time.
Toward expert-level medical question answering with large language models
Karan Singhal, Tao Tu, Juraj Gottweis, Rory Sayres, Ellery Wulczyn, Mohamed Amin, Le Hou, Kevin Clark, Stephen R Pfohl, Heather Cole-Lewis, et al · 2025
Closest in time.
Mdocagent: A multi-modal multi-agent framework for document understanding
Siwei Han, Peng Xia, Ruiyi Zhang, Tong Sun, Yun Li, Hongtu Zhu, and Huaxiu Yao · 2025
Closest in time.
Towards interpretable radiology report generation via concept bottlenecks using a multi-agentic rag
Hasan Md Tusfiqur Alam, Devansh Srivastav, Md Abdul Kadir, and Daniel Sonntag · 2025
Closest in time.