Fetching the paper…
Reading the bibliography…
Open-domain 3D object synthesis has been lagging behind image synthesis due to limited data and higher computational complexity.
The proposed uscf rating system, its development, theory, and applications
Arpad E Elo. 1967 · 1967
Earlier work this paper cites.
Laplacian Surface Editing. In Proceedings of the 2004 Eurographics/ACM SIGGRAPH Symposium on Geometry Processing (Nice, France) (SGP ’04) . Association for Computing Machinery, New York, NY, USA, 175–184
O. Sorkine, D. Cohen-Or, Y. Lipman, M. Alexa, C. Rössl, and H.-P. Seidel. 2004 · 2004
Earlier work this paper cites.
ShapeNet: An Information-Rich 3D Model Repository
Angel X. Chang, Thomas Funkhouser, Leonidas Guibas, Pat Hanrahan, Qixing Huang, Zimo Li, Silvio Savarese, Manolis Savva, Shuran Song, Hao Su, Jianxiong Xiao, Li Yi, and Fisher Yu. 2015 · 2015
Earlier work this paper cites.
Adam: A Method for Stochastic Optimization. In ICLR
Diederik P. Kingma and Jimmy Ba. 2015 · 2015
Earlier work this paper cites.
GANs Trained by a Two Time-Scale Update Rule Converge to a Local Nash Equilibrium. In NeurIPS
Martin Heusel, Hubert Ramsauer, Thomas Unterthiner, Bernhard Nessler, and Sepp Hochreiter. 2017 · 2017
Earlier work this paper cites.
The Unreasonable Effectiveness of Deep Features as a Perceptual Metric. In CVPR
Richard Zhang, Phillip Isola, Alexei Efros, Eli Shechtman, and Oliver Wang. 2018 · 2018
Earlier work this paper cites.
Scene Representation Networks: Continuous 3D-Structure-Aware Neural Scene Representations. In NeurIPS
Vincent Sitzmann, Michael Zollhöfer, and Gordon Wetzstein. 2019 · 2019
Earlier work this paper cites.
Denoising Diffusion Probabilistic Models. In NeurIPS
Jonathan Ho, Ajay Jain, and Pieter Abbeel. 2020 · 2020
Earlier work this paper cites.
NeRF: Representing Scenes as Neural Radiance Fields for View Synthesis. In ECCV
Ben Mildenhall, Pratul P. Srinivasan, Matthew Tancik, Jonathan T. Barron, Ravi Ramamoorthi, and Ren Ng. 2020 · 2020
Earlier work this paper cites.
Omnidata: A Scalable Pipeline for Making Multi-Task Mid-Level Vision Datasets From 3D Scans. In ICCV . 10786–10796
Ainaz Eftekhar, Alexander Sax, Jitendra Malik, and Amir Zamir. 2021 · 2021
Earlier work this paper cites.
Classifier-Free Diffusion Guidance. In NeurIPS Workshop
Jonathan Ho and Tim Salimans. 2021 · 2021
Earlier work this paper cites.
Learning transferable visual models from natural language supervision. In ICML . 8748–8763
Alec Radford, Jong Wook Kim, Chris Hallacy, Aditya Ramesh, Gabriel Goh, Sandhini Agarwal, Girish Sastry, Amanda Askell, Pamela Mishkin, Jack Clark, et al · 2021
Earlier work this paper cites.
Deep Marching Tetrahedra: a Hybrid Representation for High-Resolution 3D Shape Synthesis. In NeurIPS
Tianchang Shen, Jun Gao, Kangxue Yin, Ming-Yu Liu, and Sanja Fidler. 2021 · 2021
Earlier work this paper cites.
Score-Based Generative Modeling through Stochastic Differential Equations. In ICLR
Yang Song, Jascha Sohl-Dickstein, Diederik P Kingma, Abhishek Kumar, Stefano Ermon, and Ben Poole. 2021 · 2021
Earlier work this paper cites.
GAUDI: A Neural Architect for Immersive 3D Scene Generation. In NeurIPS
Miguel Angel Bautista, Pengsheng Guo, Samira Abnar, Walter Talbott, Alexander Toshev, Zhuoyuan Chen, Laurent Dinh, Shuangfei Zhai, Hanlin Goh, Daniel Ulbricht, Afshin Dehghan, and Josh Susskind. 2022 · 2022
Earlier work this paper cites.
Efficient Geometry-aware 3D Generative Adversarial Networks. In CVPR
Eric R. Chan, Connor Z. Lin, Matthew A. Chan, Koki Nagano, Boxiao Pan, Shalini De Mello, Orazio Gallo, Leonidas Guibas, Jonathan Tremblay, Sameh Khamis, Tero Karras, and Gordon Wetzstein. 2022 · 2022
Earlier work this paper cites.
Google scanned objects: A high-quality dataset of 3d scanned household items. In ICRA . 2553–2560
Laura Downs, Anthony Francis, Nate Koenig, Brandon Kinman, Ryan Hickman, Krista Reymann, Thomas B McHugh, and Vincent Vanhoucke. 2022 · 2022
Earlier work this paper cites.
From data to functa: Your data point is a function and you can treat it like one. In ICML
Emilien Dupont, Hyunjik Kim, S. M. Ali Eslami, Danilo Jimenez Rezende, and Dan Rosenbaum. 2022 · 2022
Earlier work this paper cites.
LoRA: Low-Rank Adaptation of Large Language Models. In ICLR
Edward J Hu, yelong shen, Phillip Wallis, Zeyuan Allen-Zhu, Yuanzhi Li, Shean Wang, Lu Wang, and Weizhu Chen. 2022 · 2022
Earlier work this paper cites.
Zero-Shot Text-Guided Object Generation with Dream Fields
Ajay Jain, Ben Mildenhall, Jonathan T. Barron, Pieter Abbeel, and Ben Poole. 2022 · 2022
Earlier work this paper cites.
InfoNeRF: Ray Entropy Minimization for Few-Shot Neural Volume Rendering. In CVPR
Mijeong Kim, Seonguk Seo, and Bohyung Han. 2022 · 2022
Cited alongside, same era.
TRACER: Extreme Attention Guided Salient Object Tracing Network. In AAAI
Min Seok Lee, Wooseok Shin, and Sung Won Han. 2022 · 2022
Cited alongside, same era.
BLIP: Bootstrapping Language-Image Pre-training for Unified Vision-Language Understanding and Generation. In ICML
Junnan Li, Dongxu Li, Caiming Xiong, and Steven Hoi. 2022 · 2022
Cited alongside, same era.
DPM-Solver: A Fast ODE Solver for Diffusion Probabilistic Model Sampling in Around 10 Steps. In NeurIPS
Cheng Lu, Yuhao Zhou, Fan Bao, Jianfei Chen, Chongxuan Li, and Jun Zhu. 2022 · 2022
Cited alongside, same era.
Repaint: Inpainting using denoising diffusion probabilistic models. In CVPR . 11461–11471
Andreas Lugmayr, Martin Danelljan, Andres Romero, Fisher Yu, Radu Timofte, and Luc Van Gool. 2022 · 2022
Cited alongside, same era.
DiffRF: Rendering-Guided 3D Radiance Field Diffusion. In CVPR
Norman Müller, , Yawar Siddiqui, Lorenzo Porzi, Samuel Rota Bulò, Peter Kontschieder, and Matthias Nießner. 2023 · 2023
Later among the works it cites.
OpenAI. 2023 · 2023
Later among the works it cites.
DreamFusion: Text-to-3D using 2D Diffusion. In ICLR
Ben Poole, Ajay Jain, Jonathan T. Barron, and Ben Mildenhall. 2023 · 2023
Later among the works it cites.
Texture: Text-guided texturing of 3d shapes. In SIGGRAPH
Elad Richardson, Gal Metzer, Yuval Alaluf, Raja Giryes, and Daniel Cohen-Or. 2023 · 2023
Later among the works it cites.
Zero123++: a Single Image to Consistent Multi-view Diffusion Base Model
Ruoxi Shi, Hansheng Chen, Zhuoyang Zhang, Minghua Liu, Chao Xu, Xinyue Wei, Linghao Chen, Chong Zeng, and Hao Su. 2023 · 2023
Later among the works it cites.
alphaXiv searches the wider corpus for related work and actual follow-ups.
alphaXiv is searching for related work…
SDEdit: Guided Image Synthesis and Editing with Stochastic Differential Equations. In ICLR
Chenlin Meng, Yutong He, Yang Song, Jiaming Song, Jiajun Wu, Jun-Yan Zhu, and Stefano Ermon. 2022 · 2022
Cited alongside, same era.
Instant Neural Graphics Primitives with a Multiresolution Hash Encoding
Thomas Müller, Alex Evans, Christoph Schied, and Alexander Keller. 2022 · 2022
Cited alongside, same era.
High-Resolution Image Synthesis with Latent Diffusion Models. In CVPR
Robin Rombach, Andreas Blattmann, Dominik Lorenz, Patrick Esser, and Björn Ommer. 2022 · 2022
Cited alongside, same era.
LAION-5B: An open large-scale dataset for training next generation image-text models. In NeurIPS Workshop
Christoph Schuhmann, Romain Beaumont, Richard Vencu, Cade Gordon, Ross Wightman, Mehdi Cherti, Theo Coombes, Aarush Katta, Clayton Mullis, Mitchell Wortsman, Patrick Schramowski, Srivatsa Kundurthy, Katherine Crowson, Ludwig Schmidt, Robert Kaczmarczyk, and Jenia Jitsev. 2022 · 2022
Cited alongside, same era.
Cross-Image Attention for Zero-Shot Appearance Transfer
Yuval Alaluf, Daniel Garibi, Or Patashnik, Hadar Averbuch-Elor, and Daniel Cohen-Or. 2023 · 2023
Cited alongside, same era.
RenderDiffusion: Image Diffusion for 3D Reconstruction, Inpainting and Generation. In CVPR
Titas Anciukevicius, Zexiang Xu, Matthew Fisher, Paul Henderson, Hakan Bilen, Niloy J. Mitra, and Paul Guerrero. 2023 · 2023
Cited alongside, same era.
InstructPix2Pix: Learning to Follow Image Editing Instructions. In CVPR
Tim Brooks, Aleksander Holynski, and Alexei A. Efros. 2023 · 2023
Cited alongside, same era.
3D Neural Field Generation using Triplane Diffusion. In CVPR
J Ryan Shue, Eric Ryan Chan, Ryan Po, Zachary Ankner, Jiajun Wu, and Gordon Wetzstein. 2023 · 2023
Later among the works it cites.
Diffusion with Forward Models: Solving Stochastic Inverse Problems Without Direct Supervision. In NeurIPS
Ayush Tewari, Tianwei Yin, George Cazenavette, Semon Rezchikov, Joshua B. Tenenbaum, Frédo Durand, William T. Freeman, and Vincent Sitzmann. 2023 · 2023
Later among the works it cites.
Novel View Synthesis with Diffusion Models. In ICLR
Daniel Watson, William Chan, Ricardo Martin-Brualla, Jonathan Ho, Andrea Tagliasacchi, and Mohammad Norouzi. 2023 · 2023
Later among the works it cites.
IP-Adapter: Text Compatible Image Prompt Adapter for Text-to-Image Diffusion Models
Hu Ye, Jun Zhang, Sibo Liu, Xiao Han, and Wei Yang. 2023 · 2023
Later among the works it cites.
Adding Conditional Control to Text-to-Image Diffusion Models. In ICCV
Lvmin Zhang, Anyi Rao, and Maneesh Agrawala. 2023 · 2023
Later among the works it cites.
Locally Attentional SDF Diffusion for Controllable 3D Shape Generation
Xin-Yang Zheng, Hao Pan, Peng-Shuai Wang, Xin Tong, Yang Liu, and Heung-Yeung Shum. 2023 · 2023
Later among the works it cites.
SparseFusion: Distilling View-conditioned Diffusion for 3D Reconstruction. In CVPR
Zhizhuo Zhou and Shubham Tulsiani. 2023 · 2023
Later among the works it cites.
Wonder3D: Single Image to 3D using Cross-Domain Diffusion. In CVPR
Xiaoxiao Long, Yuan-Chen Guo, Cheng Lin, Yuan Liu, Zhiyang Dou, Lingjie Liu, Yuexin Ma, Song-Hai Zhang, Marc Habermann, Christian Theobalt, and Wenping Wang. 2024 · 2024
Closest in time.
Compositional 3D Scene Generation using Locally Conditioned Diffusion. In 3DV
Ryan Po, Wang Yifan, and Vladislav Golyanik et al. 2024 · 2024
Closest in time.
Magic123: One Image to High-Quality 3D Object Generation Using Both 2D and 3D Diffusion Priors. In ICLR
Guocheng Qian, Jinjie Mai, Abdullah Hamdi, Jian Ren, Aliaksandr Siarohin, Bing Li, Hsin-Ying Lee, Ivan Skorokhodov, Peter Wonka, Sergey Tulyakov, and Bernard Ghanem. 2024 · 2024
Closest in time.
MVDream: Multi-view Diffusion for 3D Generation. In ICLR
Yichun Shi, Peng Wang, Jianglong Ye, Mai Long, Kejie Li, and Xiao Yang. 2024 · 2024
Closest in time.
Dreamcraft3d: Hierarchical 3d generation with bootstrapped diffusion prior. In ICLR
Jingxiang Sun, Bo Zhang, Ruizhi Shao, Lizhen Wang, Wen Liu, Zhenda Xie, and Yebin Liu. 2024 · 2024
Closest in time.
DreamGaussian: Generative Gaussian Splatting for Efficient 3D Content Creation. In ICLR
Jiaxiang Tang, Jiawei Ren, Hang Zhou, Ziwei Liu, and Gang Zeng. 2024 · 2024
Closest in time.
GPT-4V(ision) is a Human-Aligned Evaluator for Text-to-3D Generation. In CVPR
Tong Wu, Guandao Yang, Zhibing Li, Kai Zhang, Ziwei Liu, Leonidas Guibas, Dahua Lin, and Gordon Wetzstein. 2024 · 2024
Closest in time.
DMV3D: Denoising Multi-View Diffusion using 3D Large Reconstruction Model. In ICLR
Yinghao Xu, Hao Tan, Fujun Luan, Sai Bi, Peng Wang, Jiahao Li, Zifan Shi, Kalyan Sunkavalli, Gordon Wetzstein, Zexiang Xu, and Kai Zhang. 2024 · 2024
Closest in time.