Fetching the paper…
Reading the bibliography…
Code localization--identifying precisely where in a codebase changes need to be made--is a fundamental yet challenging task in software maintenance.
Bugswarm: Mining and continuously growing a dataset of reproducible failures and fixes
David A. Tomassi, Naji Dmeiri, Yichen Wang, Antara Bhowmick, Yen-Chuan Liu, Premkumar Devanbu, Bogdan Vasilescu, and Cindy Rubio-González. 2019 · 1903
Earlier work this paper cites.
Okapi at trec-3
Stephen E. Robertson, Steve Walker, Susan Jones, Micheline Hancock-Beaulieu, and Mike Gatford. 1994 · 1994
Earlier work this paper cites.
Graphviz—open source graph drawing tools
John Ellson, Emden Gansner, Lefteris Koutsofios, Stephen C North, and Gordon Woodhull. 2002 · 2001
Earlier work this paper cites.
The probabilistic relevance framework: Bm25 and beyond
Stephen Robertson, Hugo Zaragoza, et al. 2009 · 2009
Earlier work this paper cites.
A deep relevance matching model for ad-hoc retrieval
Jiafeng Guo, Yixing Fan, Qingyao Ai, and W Bruce Croft. 2016 · 2016
Earlier work this paper cites.
Where is the bug and how is it fixed? an experiment with practitioners
Marcel Böhme, Ezekiel O Soremekun, Sudipta Chattopadhyay, Emamurho Ugherughe, and Andreas Zeller. 2017 · 2017
Earlier work this paper cites.
A deep look into neural ranking models for information retrieval
Jiafeng Guo, Yixing Fan, Liang Pang, Liu Yang, Qingyao Ai, Hamed Zamani, Chen Wu, W Bruce Croft, and Xueqi Cheng. 2020 · 2020
Earlier work this paper cites.
Retrieval augmented language model pre-training
Kelvin Guu, Kenton Lee, Zora Tung, Panupong Pasupat, and Mingwei Chang. 2020 · 2020
Earlier work this paper cites.
Retrieval-augmented generation for knowledge-intensive nlp tasks
Patrick Lewis, Ethan Perez, Aleksandra Piktus, Fabio Petroni, Vladimir Karpukhin, Naman Goyal, Heinrich Küttler, Mike Lewis, Wen-tau Yih, Tim Rocktäschel, et al. 2020 · 2020
Earlier work this paper cites.
Open-retrieval conversational question answering
Chen Qu, Liu Yang, Cen Chen, Minghui Qiu, W Bruce Croft, and Mohit Iyyer. 2020 · 2020
Earlier work this paper cites.
Lora: Low-rank adaptation of large language models
Edward J Hu, Yelong Shen, Phillip Wallis, Zeyuan Allen-Zhu, Yuanzhi Li, Shean Wang, Lu Wang, and Weizhu Chen. 2021 · 2021
Earlier work this paper cites.
Are we really making much progress? revisiting, benchmarking and refining heterogeneous graph neural networks
Qingsong Lv, Ming Ding, Qiang Liu, Yuxiang Chen, Wenzheng Feng, Siming He, Chang Zhou, Jianguo Jiang, Yuxiao Dong, and Jie Tang. 2021 · 2021
Earlier work this paper cites.
Text embeddings by weakly-supervised contrastive pre-training
Liang Wang, Nan Yang, Xiaolong Huang, Binxing Jiao, Linjun Yang, Daxin Jiang, Rangan Majumder, and Furu Wei. 2022 · 2022
Earlier work this paper cites.
Talk like a graph: Encoding graphs for large language models
Bahare Fatemi, Jonathan Halcrow, and Bryan Perozzi. 2023 · 2023
Earlier work this paper cites.
Jina embeddings: A novel set of high-performance sentence embedding models
Michael Günther, Louis Milliken, Jonathan Geuter, Georgios Mastrapas, Bo Wang, and Han Xiao. 2023 · 2023
Earlier work this paper cites.
Swe-bench: Can language models resolve real-world github issues?
Carlos E Jimenez, John Yang, Alexander Wettig, Shunyu Yao, Kexin Pei, Ofir Press, and Karthik Narasimhan. 2023 · 2023
Cited alongside, same era.
A preliminary evaluation of llm-based fault localization
Sungmin Kang, Gabin An, and Shin Yoo. 2023 · 2023
Cited alongside, same era.
Large language models in fault localisation
Yonghao Wu, Zheng Li, Jie M Zhang, Mike Papadakis, Mark Harman, and Yong Liu. 2023 · 2023
Cited alongside, same era.
T-eval: Evaluating the tool utilization capability of large language models step by step
Zehui Chen, Weihua Du, Wenwei Zhang, Kuikun Liu, Jiangning Liu, Miao Zheng, Jingming Zhuo, Songyang Zhang, Dahua Lin, Kai Chen, et al. 2024 · 2024
Cited alongside, same era.
Introducing devin, the first ai software engineer
Agentless: Demystifying llm-based software engineering agents
Chunqiu Steven Xia, Yinlin Deng, Soren Dunn, and Lingming Zhang. 2024 · 2024
Later among the works it cites.
Swe-agent: Agent-computer interfaces enable automated software engineering
John Yang, Carlos E Jimenez, Alexander Wettig, Kilian Lieret, Shunyu Yao, Karthik Narasimhan, and Ofir Press. 2024 · 2024
Later among the works it cites.
CODE REPRESENTATION LEARNING AT SCALE
Dejiao Zhang, Wasi Uddin Ahmad, Ming Tan, Hantian Ding, Ramesh Nallapati, Dan Roth, Xiaofei Ma, and Bing Xiang. 2024 · 2024
Later among the works it cites.
Moatless tools
Albert Örwall. 2024 · 2024
Later among the works it cites.
Building a better repository map with tree sitter
Aider. 2023 · 2025
Closest in time.
Claude: Conversational ai by anthropic
alphaXiv searches the wider corpus for related work and actual follow-ups.
alphaXiv is searching for related work…
Cognition.ai. 2024 · 2024
Cited alongside, same era.
Qwen2.5-coder technical report
Binyuan Hui, Jian Yang, Zeyu Cui, Jiaxi Yang, Dayiheng Liu, Lei Zhang, Tianyu Liu, Jiajun Zhang, Bowen Yu, Keming Lu, Kai Dang, Yang Fan, Yichang Zhang, An Yang, Rui Men, Fei Huang, Bo Zheng, Yibo Miao, Shanghaoran Quan, Yunlong Feng, Xingzhang Ren, Xuancheng Ren, Jingren Zhou, and Junyang Lin. 2024 · 2024
Cited alongside, same era.
A quantitative and qualitative evaluation of llm-based explainable fault localization
Sungmin Kang, Gabin An, and Shin Yoo. 2024 · 2024
Cited alongside, same era.
Codexgraph: Bridging large language models and code repositories via code graph databases
Xiangyan Liu, Bo Lan, Zhiyuan Hu, Yang Liu, Zhicheng Zhang, Fei Wang, Michael Shieh, and Wenmeng Zhou. 2024 · 2024
Cited alongside, same era.
How to understand whole software repository?
Yingwei Ma, Qingping Yang, Rongyu Cao, Binhua Li, Fei Huang, and Yongbin Li. 2024 · 2024
Cited alongside, same era.
Swt-bench: Testing and validating real-world bug-fixes with code agents
Niels Mündler, Mark Müller, Jingxuan He, and Martin Vechev. 2024 · 2024
Cited alongside, same era.
Agentfl: Scaling llm-based fault localization to project-level context
Yihao Qin, Shangwen Wang, Yiling Lou, Jinhao Dong, Kaixin Wang, Xiaoling Li, and Xiaoguang Mao. 2024 · 2024
Cited alongside, same era.
Cornstack: High-quality contrastive data for better code ranking
Tarun Suresh, Revanth Gangi Reddy, Yifei Xu, Zach Nussbaum, Andriy Mulyar, Brandon Duderstadt, and Heng Ji. 2024 · 2024
Cited alongside, same era.
Anthropic. 2023 · 2025
Closest in time.
Artificial analysis
artificialanalysis.ai. 2025 · 2025
Closest in time.
How aider scored sota 26.3% on swe bench lite | aider
Paul Gauthier. 2024 · 2025
Closest in time.
Hyperbolic website
Hyperbolic. 2025 · 2025
Closest in time.
Chatgpt: Language model by openai
OpenAI. 2023 · 2025
Closest in time.
Repograph: Enhancing AI software engineering with repository-level code graph
Siru Ouyang, Wenhao Yu, Kaixin Ma, Zilin Xiao, Zhihan Zhang, Mengzhao Jia, Jiawei Han, Hongming Zhang, and Dong Yu. 2025 · 2025
Closest in time.
Perplexity ai: An ai-powered search engine
PerplexityAI. 2023 · 2025
Closest in time.
Openhands: An open platform for AI software developers as generalist agents
Xingyao Wang, Boxuan Li, Yufan Song, Frank F. Xu, Xiangru Tang, Mingchen Zhuge, Jiayi Pan, Yueqi Song, Bowen Li, Jaskirat Singh, Hoang H. Tran, Fuqiang Li, Ren Ma, Mingzhang Zheng, Bill Qian, Yanjun Shao, Niklas Muennighoff, Yizhe Zhang, Binyuan Hui, Junyang Lin, Robert Brennan, Hao Peng, Heng Ji, and Graham Neubig. 2025 · 2025
Closest in time.
Orcaloca: An llm agent framework for software issue localization
Zhongming Yu, Hejia Zhang, Yujie Zhao, Hanxian Huang, Matrix Yao, Ke Ding, and Jishen Zhao. 2025 · 2025
Closest in time.