Flow matching for generative modeling
Original
Yaron Lipman, Ricky TQ Chen, Heli Ben-Hamu, Maximilian Nickel, and Matt Le · 2022
Later among the works it cites.
Scalable diffusion models with transformers
Original
William Peebles and Saining Xie · 2022
Later among the works it cites.
DreamFusion: Text-to-3D using 2D Diffusion
Ben Poole, Ajay Jain, Jonathan T. Barron, and Ben Mildenhall · 2022
Later among the works it cites.
Hierarchical Text-Conditional Image Generation with CLIP Latents
Aditya Ramesh, Prafulla Dhariwal, Alex Nichol, Casey Chu, and Mark Chen · 2022
Later among the works it cites.
Progressive distillation for fast sampling of diffusion models
Original
Tim Salimans and Jonathan Ho · 2022
Later among the works it cites.
Novel View Synthesis with Diffusion Models
Daniel Watson, Ricardo Chan, William Martin-Brualla, Jonathan Ho, Andrea Tagliasacchi, and Mohammad Norouzi · 2022
Later among the works it cites.
Deblurring via Stochastic Refinement
Jay Whang, Mauricio Delbracio, Hossein Talebi, Chitwan Saharia, Alexandros G. Dimakis, and Peyman Milanfar · 2022
Later among the works it cites.
Scaling Autoregressive Models for Content-Rich Text-to-Image Generation
Original
Jiahui Yu, Yuanzhong Xu, Jing Yu Koh, Thang Luong, Gunjan Baid, Zirui Wang, Vijay Vasudevan, Alexander Ku, Yinfei Yang, Burcu Karagol Ayan, Ben Hutchinson, Wei Han, Zarana Parekh, Xin Li, Han Zhang, and Yonghui Wu Jason Baldridge · 2022
Later among the works it cites.
All are worth words: A vit backbone for diffusion models
Fan Bao, Shen Nie, Kaiwen Xue, Yue Cao, Chongxuan Li, Hang Su, and Jun Zhu · 2023
Closest in time.
Inversion by direct iteration: An alternative to denoising diffusion for image restoration
Original
Mauricio Delbracio and Peyman Milanfar · 2023
Closest in time.
Masked diffusion transformer is a strong image synthesizer
Original
Shanghua Gao, Pan Zhou, Ming-Ming Cheng, and Shuicheng Yan · 2023
Closest in time.
Efficient diffusion training via min-snr weighting strategy
Original
Tiankai Hang, Shuyang Gu, Chen Li, Jianmin Bao, Dong Chen, Han Hu, Xin Geng, and Baining Guo · 2023
Closest in time.
simple diffusion: End-to-end diffusion for high resolution images
Original
Emiel Hoogeboom, Jonathan Heek, and Tim Salimans · 2023
Closest in time.
Voicebox: Text-guided multilingual universal speech generation at scale
Original
Matthew Le, Apoorv Vyas, Bowen Shi, Brian Karrer, Leda Sari, Rashel Moritz, Mary Williamson, Vimal Manohar, Yossi Adi, Jay Mahadeokar, et al · 2023
Closest in time.