An image is worth one word: Personalizing text-to-image generation using textual inversion
Original
Rinon Gal, Yuval Alaluf, Yuval Atzmon, Or Patashnik, Amit H Bermano, Gal Chechik, and Daniel Cohen-Or · 2022
Cited alongside, same era.
Prompt-to-prompt image editing with cross attention control
Original
Amir Hertz, Ron Mokady, Jay Tenenbaum, Kfir Aberman, Yael Pritch, and Daniel Cohen-Or · 2022
Cited alongside, same era.
Classifier-free diffusion guidance
Original
Jonathan Ho and Tim Salimans · 2022
Cited alongside, same era.
High-resolution image synthesis with latent diffusion models
Robin Rombach, Andreas Blattmann, Dominik Lorenz, Patrick Esser, and Björn Ommer · 2022
Cited alongside, same era.
Fineformer: Fine-grained adaptive object transformer for image captioning
Bo Wang, Zhao Zhang, Jicong Fan, Mingbo Zhao, Choujun Zhan, and Mingliang Xu · 2022
Cited alongside, same era.
Investigating prompt engineering in diffusion models
Original
Sam Witteveen and Martin Andrews · 2022
Cited alongside, same era.
FCL-GAN: A lightweight and real-time baseline for unsupervised blind image deblurring
Suiyi Zhao, Zhao Zhang, Richang Hong, Mingliang Xu, Yi Yang, and Meng Wang · 2022
Cited alongside, same era.
Zero-shot generative model adaptation via image-specific prompt learning
Jiayi Guo, Chaofei Wang, You Wu, Eric Zhang, Kai Wang, Xingqian Xu, Humphrey Shi, Gao Huang, and Shiji Song · 2023
Cited alongside, same era.
Imagic: Text-based real image editing with diffusion models
Bahjat Kawar, Shiran Zada, Oran Lang, Omer Tov, Huiwen Chang, Tali Dekel, Inbar Mosseri, and Michal Irani · 2023
Cited alongside, same era.
Dreamix: Video diffusion models are general video editors
Original
Eyal Molad, Eliahu Horwitz, Dani Valevski, Alex Rav Acha, Yossi Matias, Yael Pritch, Yaniv Leviathan, and Yedid Hoshen · 2023
Cited alongside, same era.
Blip-diffusion: Pre-trained subject representation for controllable text-to-image generation and editing
Original
Dongxu Li, Junnan Li, and Steven CH Hoi
Cited in the paper.
Blip-2: Bootstrapping language-image pre-training with frozen image encoders and large language models
Original
Junnan Li, Dongxu Li, Silvio Savarese, and Steven Hoi
Cited in the paper.