Fetching the paper…
Reading the bibliography…
Multi-layer image generation is a fundamental task that enables users to isolate, select, and edit specific image layers, thereby revolutionizing interactions with generative models.
Critique of pure reason
Immanuel Kant, John Miller Dow Meiklejohn, Thomas Kingsmill Abbott, and James Creed Meredith · 1934
Earlier work this paper cites.
Schema theory: An information processing model of perception and cognition
Robert Axelrod · 1973
Earlier work this paper cites.
The Fréchet distance between multivariate normal distributions
DC Dowson and BV Landau · 1982
Earlier work this paper cites.
Remembering: A study in experimental and social psychology
Frederic Charles Bartlett · 1995
Earlier work this paper cites.
Microsoft COCO: Common objects in context
Tsung-Yi Lin, Michael Maire, Serge Belongie, James Hays, Pietro Perona, Deva Ramanan, Piotr Dollár, and C Lawrence Zitnick · 2014
Earlier work this paper cites.
Schemata: The building blocks of cognition
David E Rumelhart · 2017
Earlier work this paper cites.
An Image is Worth 16x16 Words: Transformers for image recognition at scale
Alexey Dosovitskiy, Lucas Beyer, Alexander Kolesnikov, Dirk Weissenborn, Xiaohua Zhai, Thomas Unterthiner, Mostafa Dehghani, Matthias Minderer, Georg Heigold, Sylvain Gelly, Jakob Uszkoreit, and Neil Houlsby · 2021
Earlier work this paper cites.
CanvasVAE: Learning to generate vector graphic documents
Kota Yamaguchi · 2021
Earlier work this paper cites.
Coarse-to-fine generative modeling for graphic layouts
Zhaoyun Jiang, Shizhao Sun, Jihua Zhu, Jian-Guang Lou, and Dongmei Zhang · 2022
Earlier work this paper cites.
BLT: Bidirectional layout transformer for controllable layout generation
Xiang Kong, Lu Jiang, Huiwen Chang, Han Zhang, Yuan Hao, Haifeng Gong, and Irfan Essa · 2022
Earlier work this paper cites.
Photorealistic text-to-image diffusion models with deep language understanding
Chitwan Saharia, William Chan, Saurabh Saxena, Lala Li, Jay Whang, Emily L Denton, Kamyar Ghasemipour, Raphael Gontijo Lopes, Burcu Karagol Ayan, Tim Salimans, et al · 2022
Earlier work this paper cites.
MultiDiffusion: Fusing diffusion paths for controlled image generation
Omer Bar-Tal, Lior Yariv, Yaron Lipman, and Tali Dekel · 2023
Earlier work this paper cites.
Improving image generation with better captions
James Betker, Gabriel Goh, Li Jing, Tim Brooks, Jianfeng Wang, Linjie Li, Long Ouyang, Juntang Zhuang, Joyce Lee, Yufei Guo, et al · 2023
Earlier work this paper cites.
Align your Latents: High-resolution video synthesis with latent diffusion models
Andreas Blattmann, Robin Rombach, Huan Ling, Tim Dockhorn, Seung Wook Kim, Sanja Fidler, and Karsten Kreis · 2023
Earlier work this paper cites.
LayoutDM: Transformer-based diffusion model for layout generation
Shang Chai, Liansheng Zhuang, and Fengying Yan · 2023
Earlier work this paper cites.
Play: Parametrically conditioned layout generation using latent diffusion
Chin-Yi Cheng, Forrest Huang, Gang Li, and Yang Li · 2023
Earlier work this paper cites.
Unifying layout generation with a decoupled diffusion model
Mude Hui, Zhizheng Zhang, Xiaoyi Zhang, Wenxuan Xie, Yuwang Wang, and Yan Lu · 2023
Earlier work this paper cites.
COLE: A hierarchical generation framework for graphic design
Peidong Jia, Chenxuan Li, Zeyu Liu, Yichao Shen, Xingru Chen, Yuhui Yuan, Yinglin Zheng, Dong Chen, Ji Li, Xiaodong Xie, et al · 2023
Cited alongside, same era.
LayoutFormer++: Conditional graphic layout generation via constraint serialization and decoding space restriction
Zhaoyun Jiang, Jiaqi Guo, Shizhao Sun, Huayu Deng, Zhongkai Wu, Vuksan Mijovic, Zijiang James Yang, Jian-Guang Lou, and Dongmei Zhang · 2023
Cited alongside, same era.
Dense text-to-image generation with attention modulation
Yunji Kim, Jiyoung Lee, Jin-Hwa Kim, Jung-Woo Ha, and Jun-Yan Zhu · 2023
Cited alongside, same era.
GLIGEN: Open-set grounded text-to-image generation
Yuheng Li, Haotian Liu, Qingyang Wu, Fangzhou Mu, Jianwei Yang, Jianfeng Gao, Chunyuan Li, and Yong Jae Lee · 2023
Cited alongside, same era.
Prodigy: An expeditiously adaptive parameter-free learner
Konstantin Mishchenko and Aaron Defazio · 2023
LayoutFlow: Flow matching for layout generation
Julian Jorge Andrade Guerreiro, Naoto Inoue, Kento Masui, Mayu Otani, and Hideki Nakayama · 2024
Later among the works it cites.
AnimateDiff: Animate your personalized text-to-image diffusion models without specific tuning
Yuwei Guo, Ceyuan Yang, Anyi Rao, Zhengyang Liang, Yaohui Wang, Yu Qiao, Maneesh Agrawala, Dahua Lin, and Bo Dai · 2024
Later among the works it cites.
LayerDiff: Exploring text-guided multi-layered composable image synthesis via layer-collaborative diffusion model
Runhui Huang, Kaixin Cai, Jianhua Han, Xiaodan Liang, Renjing Pei, Guansong Lu, Songcen Xu, Wei Zhang, and Hang Xu · 2024
Later among the works it cites.
OpenCOLE: Towards reproducible automatic graphic design generation
Naoto Inoue, Kento Masui, Wataru Shimoda, and Kota Yamaguchi · 2024
Later among the works it cites.
Multimodal markup document models for graphic design completion
Kotaro Kikuchi, Naoto Inoue, Mayu Otani, Edgar Simo-Serra, and Kota Yamaguchi · 2024
alphaXiv searches the wider corpus for related work and actual follow-ups.
alphaXiv is searching for related work…
Cited alongside, same era.
LayoutNUWA: Revealing the hidden layout expertise of large language models
Zecheng Tang, Chenfei Wu, Juntao Li, and Nan Duan · 2023
Cited alongside, same era.
ReCo: Region-controlled text-to-image generation
Zhengyuan Yang, Jianfeng Wang, Zhe Gan, Linjie Li, Kevin Lin, Chenfei Wu, Nan Duan, Zicheng Liu, Ce Liu, Michael Zeng, et al · 2023
Cited alongside, same era.
Text2Layer: Layered image generation using latent diffusion model
Xinyang Zhang, Wentian Zhao, Xin Lu, and Jeff Chien · 2023
Cited alongside, same era.
Slayr: Scene layout generation with rectified flow
Cameron Braunstein, Hevra Petekkaya, Jan Eric Lenssen, Mariya Toneva, and Eddy Ilg · 2024
Cited alongside, same era.
MAGICK: A large-scale captioned dataset from matting generated images using chroma keying
Ryan D Burgert, Brian L Price, Jason Kuen, Yijun Li, and Michael S Ryoo · 2024
Cited alongside, same era.
TextLap: Customizing language models for text-to-layout planning
Jian Chen, Ruiyi Zhang, Yufan Zhou, Jennifer Healey, Jiuxiang Gu, Zhiqiang Xu, and Changyou Chen · 2024
Cited alongside, same era.
Graphic design with large multimodal model
Yutao Cheng, Zhao Zhang, Maoke Yang, Hui Nie, Chunyuan Li, Xinglong Wu, and Jie Shao · 2024
Cited alongside, same era.
Later among the works it cites.
Flux.1 model family, 2024
Black Forest Labs · 2024
Later among the works it cites.
Improved baselines with visual instruction tuning
Haotian Liu, Chunyuan Li, Yuheng Li, and Yong Jae Lee · 2024
Later among the works it cites.
SDXL: Improving latent diffusion models for high-resolution image synthesis
Dustin Podell, Zion English, Kyle Lacey, Andreas Blattmann, Tim Dockhorn, Jonas Müller, Joe Penna, and Robin Rombach · 2024
Later among the works it cites.
Collage diffusion
Vishnu Sarukkai, Linden Li, Arden Ma, Christopher Ré, and Kayvon Fatahalian · 2024
Later among the works it cites.
Visual Layout Composer: Image-vector dual diffusion model for design layout generation
Mohammad Amin Shabani, Zhaowen Wang, Difan Liu, Nanxuan Zhao, Jimei Yang, and Yasutaka Furukawa · 2024
Later among the works it cites.
RoFormer: Enhanced transformer with rotary position embedding
Jianlin Su, Murtadha Ahmed, Yu Lu, Shengfeng Pan, Wen Bo, and Yunfeng Liu · 2024
Later among the works it cites.
Omost github page, 2024
Omost Team · 2024
Later among the works it cites.
MULAN: A multi layer annotated dataset for controllable text-to-image generation
Petru-Daniel Tudosiu, Yongxin Yang, Shifeng Zhang, Fei Chen, Steven McDonagh, Gerasimos Lampouras, Ignacio Iacobacci, and Sarah Parisot · 2024
Later among the works it cites.
Desigen: A pipeline for controllable design template generation
Haohan Weng, Danqing Huang, Yu Qiao, Zheng Hu, Chin-Yew Lin, Tong Zhang, and CL Chen · 2024
Later among the works it cites.
Transparent image layer diffusion using latent transparency
Lvmin Zhang and Maneesh Agrawala · 2024
Later among the works it cites.
Xinchen Zhang, Ling Yang, Guohao Li, Yaqi Cai, Jiake Xie, Yong Tang, Yujiu Yang, Mengdi Wang, and Bin Cui · 2024
Later among the works it cites.