Fetching the paper…
Reading the bibliography…
Knowledge editing for large language models can offer an efficient solution to alter a model's behavior without negatively impacting the overall performance.
Language models are unsupervised multitask learners
Alec Radford, Jeff Wu, Rewon Child, David Luan, Dario Amodei, and Ilya Sutskever · 2019
Earlier work this paper cites.
Language models are few-shot learners
Tom B. Brown and et al · 2020
Earlier work this paper cites.
Editable neural networks
Anton Sinitsin, Vsevolod Plokhotnyuk, Dmitry V. Pyrkin, Sergei Popov, and Artem Babenko · 2020
Earlier work this paper cites.
Editing factual knowledge in language models
Nicola De Cao, Wilker Aziz, and Ivan Titov · 2021
Earlier work this paper cites.
Knowledge neurons in pretrained transformers
Damai Dai, Li Dong, Yaru Hao, Zhifang Sui, Baobao Chang, and Furu Wei · 2022
Earlier work this paper cites.
Calibrating factual knowledge in pretrained language models
Qingxiu Dong, Damai Dai, Yifan Song, Jingjing Xu, Zhifang Sui, and Lei Li · 2022
Earlier work this paper cites.
Aging with GRACE: lifelong model editing with discrete key-value adaptors
Thomas Hartvigsen and et al · 2022
Earlier work this paper cites.
Lora: Low-rank adaptation of large language models
Edward J. Hu, Yelong Shen, Phillip Wallis, Zeyuan Allen-Zhu, Yuanzhi Li, Shean Wang, Lu Wang, and Weizhu Chen · 2022
Earlier work this paper cites.
Contrastive demonstration tuning for pre-trained language models
Xiaozhuan Liang, Ningyu Zhang, Siyuan Cheng, Zhenru Zhang, Chuanqi Tan, and Huajun Chen · 2022
Earlier work this paper cites.
Locating and editing factual knowledge in GPT
Kevin Meng, David Bau, Alex Andonian, and Yonatan Belinkov · 2022
Earlier work this paper cites.
Mass-editing memory in a transformer
Kevin Meng, Arnab Sen Sharma, Alex Andonian, Yonatan Belinkov, and David Bau · 2022
Earlier work this paper cites.
Fast model editing at scale
Eric Mitchell, Charles Lin, Antoine Bosselut, Chelsea Finn, and Christopher D. Manning · 2022
Earlier work this paper cites.
Memory-based model editing at scale
Eric Mitchell, Charles Lin, Antoine Bosselut, Christopher D. Manning, and Chelsea Finn · 2022
Earlier work this paper cites.
The blog used to introduce chatgpt
OpenAI · 2022
Earlier work this paper cites.
Training language models to follow instructions with human feedback
Long Ouyang and et al · 2022
Earlier work this paper cites.
Finetuned language models are zero-shot learners
Jason Wei, Maarten Bosma, Vincent Y. Zhao, Kelvin Guu, Adams Wei Yu, Brian Lester, Nan Du, Andrew M. Dai, and Quoc V. Le · 2022
Earlier work this paper cites.
Language anisotropic cross-lingual model editing
Yang Xu, Yutai Hou, and Wanxiang Che · 2022
Earlier work this paper cites.
Dune: Dataset for unified editing
Afra Feyza Akyürek, Eric Pan, Garry Kuwanto, and Derry Wijaya · 2023
Earlier work this paper cites.
Edit at your own risk: evaluating the robustness of edited models to distribution shifts, 2023
Davis Brown and et al · 2023
Earlier work this paper cites.
Can we edit multimodal large language models?
Siyuan Cheng and et al · 2023
Earlier work this paper cites.
Evaluating the ripple effects of knowledge editing in language models
Roi Cohen, Eden Biran, Ori Yoran, Amir Globerson, and Mor Geva · 2023
Earlier work this paper cites.
Erasing concepts from diffusion models
Rohit Gandikota, Joanna Materzynska, Jaden Fiotto-Kaufman, and David Bau · 2023
Earlier work this paper cites.
Editing commonsense knowledge in GPT
Anshita Gupta, Debanjan Mondal, Akshay Krishna Sheshadri, Wenlong Zhao, Xiang Lorraine Li, Sarah Wiegreffe, and Niket Tandon · 2023
Cited alongside, same era.
Does localization inform editing? surprising differences in causality-based localization vs. knowledge editing in language models, 2023
Peter Hase, Mohit Bansal, Been Kim, and Asma Ghandeharioun · 2023
Cited alongside, same era.
Linearity of relation decoding in transformer language models, 2023
Evan Hernandez and et at · 2023
Cited alongside, same era.
Transformer-patcher: One mistake worth one neuron
Zeyu Huang, Yikang Shen, Xiaofeng Zhang, Jie Zhou, Wenge Rong, and Zhang Xiong · 2023
Cited alongside, same era.
Editing models with task arithmetic
Gabriel Ilharco, Marco Tulio Ribeiro, Mitchell Wortsman, Ludwig Schmidt, Hannaneh Hajishirzi, and Ali Farhadi · 2023
Cited alongside, same era.
Klob: a benchmark for assessing knowledge locating methods in language models, 2023
Knowledge editing for large language models: A survey, 2023
Song Wang and et al · 2023
Later among the works it cites.
Cross-lingual knowledge editing in large language models, 2023
Jiaan Wang, Yunlong Liang, Zengkui Sun, Yuxuan Cao, and Jiarong Xu · 2023
Later among the works it cites.
Assessing knowledge editing in language models via relation perspective, 2023
Yifan Wei, Xiaoyan Yu, Huanhuan Ma, Fangyu Lei, Yixuan Weng, Ran Song, and Kang Liu · 2023
Later among the works it cites.
Eva-kellm: A new benchmark for evaluating knowledge editing of llms
Suhang Wu, Minlong Peng, Yue Chen, Jinsong Su, and Mingming Sun · 2023
Later among the works it cites.
Editing large language models: Problems, methods, and opportunities
Yunzhi Yao, Peng Wang, Bozhong Tian, Siyuan Cheng, Zhoubo Li, Shumin Deng, Huajun Chen, and Ningyu Zhang · 2023
Later among the works it cites.
alphaXiv searches the wider corpus for related work and actual follow-ups.
alphaXiv is searching for related work…
Yiming Ju and Zheng Zhang · 2023
Cited alongside, same era.
Inference-time intervention: Eliciting truthful answers from a language model
Kenneth Li, Oam Patel, Fernanda Viégas, Hanspeter Pfister, and Martin Wattenberg · 2023
Cited alongside, same era.
Pmet: Precise model editing in a transformer
Xiaopeng Li, Shasha Li, Shezheng Song, Jing Yang, Jun Ma, and Jie Yu · 2023
Cited alongside, same era.
Unveiling the pitfalls of knowledge editing for large language models
Zhoubo Li, Ningyu Zhang, Yunzhi Yao, Mengru Wang, Xi Chen, and Huajun Chen · 2023
Cited alongside, same era.
Evaluating dependencies in fact editing for language models: Specificity and implication awareness
Zichao Li, Ines Arous, Siva Reddy, and Jackie C. K. Cheung · 2023
Cited alongside, same era.
Editing personality for llms
Shengyu Mao, Ningyu Zhang, Xiaohan Wang, Mengru Wang, Yunzhi Yao, Yong Jiang, Pengjun Xie, Fei Huang, and Huajun Chen · 2023
Cited alongside, same era.
A survey on knowledge editing of neural networks, 2023
Vittorio Mazzia and et al · 2023
Cited alongside, same era.
Shengyu Zhang and et al · 2023
Later among the works it cites.
Editing large language models
Ningyu Zhang, Yunzhi Yao, and Shumin Deng · 2023
Later among the works it cites.
A survey of large language models
Wayne Xin Zhao and et al · 2023
Later among the works it cites.
Can we edit factual knowledge by in-context learning?
Ce Zheng, Lei Li, Qingxiu Dong, Yuxuan Fan, Zhiyong Wu, Jingjing Xu, and Baobao Chang · 2023
Later among the works it cites.
Mquake: Assessing knowledge editing in language models via multi-hop questions
Zexuan Zhong, Zhengxuan Wu, Christopher D. Manning, Christopher Potts, and Danqi Chen · 2023
Later among the works it cites.
Editing language model-based knowledge graph embeddings
Siyuan Cheng, Ningyu Zhang, Bozhong Tian, Xi Chen, Qingbing Liu, and Huajun Chen · 2024
Closest in time.
Model editing can hurt general abilities of large language models, 2024
Jia-Chen Gu, Hao-Xiang Xu, Jun-Yu Ma, Pan Lu, Zhen-Hua Ling, Kai-Wei Chang, and Nanyun Peng · 2024
Closest in time.
Model editing at scale leads to gradual and catastrophic forgetting, 2024
Akshat Gupta, Anurag Rao, and Gopala Anumanchipalli · 2024
Closest in time.
See the unseen: Better context-consistent knowledge-editing by noises, 2024
Youcheng Huang, Wenqiang Lei, Zheng Zhang, Jiancheng Lv, and Shuicheng Yan · 2024
Closest in time.
Large language models relearn removed concepts, 2024
Michelle Lo, Shay B. Cohen, and Fazl Barez · 2024
Closest in time.
Neighboring perturbations of knowledge editing on large language models, 2024
Jun-Yu Ma and et al · 2024
Closest in time.
Mpn: Leveraging multilingual patch neuron for cross-lingual model editing, 2024
Nianwen Si, Hao Zhang, and Weiqiang Zhang · 2024
Closest in time.
Massive editing for large language models via meta learning
Chenmien Tan, Ge Zhang, and Jie Fu · 2024
Closest in time.
History matters: Temporal knowledge editing in large language model
Xunjian Yin, Jin Jiang, Liming Yang, and Xiaojun Wan · 2024
Closest in time.
MELO: enhancing model editing with neuron-indexed dynamic lora
Lang Yu and et al · 2024
Closest in time.
A comprehensive study of knowledge editing for large language models, 2024
Ningyu Zhang and et al · 2024
Closest in time.