Fetching the paper…
Reading the bibliography…
In the field of digital content creation, generating high-quality 3D characters from single images is challenging, especially given the complexities of various body poses and the issues of self-occlusion and pose ambiguity.
Poisson image editing
Patrick Pérez, Michel Gangnet, and Andrew Blake. 2003 · 2003
Earlier work this paper cites.
Mixamo’s online services
MixamoInc. 2009 · 2009
Earlier work this paper cites.
SMPL: a skinned multi-person linear model
Matthew Loper, Naureen Mahmood, Javier Romero, Gerard Pons-Moll, and Michael J. Black. 2015 · 2015
Earlier work this paper cites.
Learning a model of facial shape and expression from 4D scans
Tianye Li, Timo Bolkart, Michael J. Black, Hao Li, and Javier Romero. 2017 · 2017
Earlier work this paper cites.
The Unreasonable Effectiveness of Deep Features as a Perceptual Metric. In 2018 IEEE Conference on Computer Vision and Pattern Recognition, CVPR 2018, Salt Lake City, UT, USA, June 18-22, 2018 . Computer Vision Foundation / IEEE Computer Society, 586–595
Richard Zhang, Phillip Isola, Alexei A. Efros, Eli Shechtman, and Oliver Wang. 2018 · 2018
Earlier work this paper cites.
OpenPose: Realtime Multi-Person 2D Pose Estimation Using Part Affinity Fields
Zhe Cao, Gines Hidalgo, Tomas Simon, Shih-En Wei, and Yaser Sheikh. 2021 · 2019
Earlier work this paper cites.
Expressive Body Capture: 3D Hands, Face, and Body From a Single Image. In IEEE Conference on Computer Vision and Pattern Recognition, CVPR 2019, Long Beach, CA, USA, June 16-20, 2019 . Computer Vision Foundation / IEEE, 10975–10985
Georgios Pavlakos, Vasileios Choutas, Nima Ghorbani, Timo Bolkart, Ahmed A. A. Osman, Dimitrios Tzionas, and Michael J. Black. 2019 · 2019
Earlier work this paper cites.
VRM tools of three.js
Pixiv. 2019 · 2019
Earlier work this paper cites.
PIFu: Pixel-Aligned Implicit Function for High-Resolution Clothed Human Digitization. In 2019 IEEE/CVF International Conference on Computer Vision, ICCV 2019, Seoul, Korea (South), October 27 - November 2, 2019 . IEEE, 2304–2314
Shunsuke Saito, Zeng Huang, Ryota Natsume, Shigeo Morishima, Hao Li, and Angjoo Kanazawa. 2019 · 2019
Earlier work this paper cites.
Modular primitives for high-performance differentiable rendering
Samuli Laine, Janne Hellsten, Tero Karras, Yeongho Seol, Jaakko Lehtinen, and Timo Aila. 2020 · 2020
Earlier work this paper cites.
PIFuHD: Multi-Level Pixel-Aligned Implicit Function for High-Resolution 3D Human Digitization. In 2020 IEEE/CVF Conference on Computer Vision and Pattern Recognition, CVPR 2020, Seattle, WA, USA, June 13-19, 2020 . Computer Vision Foundation / IEEE, 81–90
Shunsuke Saito, Tomas Simon, Jason M. Saragih, and Hanbyul Joo. 2020 · 2020
Earlier work this paper cites.
Pixel2Mesh: 3D Mesh Model Generation via Image Guided Deformation
Nanyang Wang, Yinda Zhang, Zhuwen Li, Yanwei Fu, Hang Yu, Wei Liu, Xiangyang Xue, and Yu-Gang Jiang. 2021b · 2020
Earlier work this paper cites.
imGHUM: Implicit Generative Models of 3D Human Shape and Articulated Pose. In 2021 IEEE/CVF International Conference on Computer Vision, ICCV 2021, Montreal, QC, Canada, October 10-17, 2021 . IEEE, 5441–5450
Thiemo Alldieck, Hongyi Xu, and Cristian Sminchisescu. 2021 · 2021
Earlier work this paper cites.
Deep Marching Tetrahedra: a Hybrid Representation for High-Resolution 3D Shape Synthesis. In Advances in Neural Information Processing Systems 34: Annual Conference on Neural Information Processing Systems 2021, NeurIPS 2021, December 6-14, 2021, virtual , Marc’Aurelio Ranzato, Alina Beygelzimer, Yann N. Dauphin, Percy Liang, and Jennifer Wortman Vaughan (Eds.). 6087–6101
Tianchang Shen, Jun Gao, Kangxue Yin, Ming-Yu Liu, and Sanja Fidler. 2021 · 2021
Earlier work this paper cites.
3D Reconstruction of Novel Object Shapes from Single Images. In International Conference on 3D Vision, 3DV 2021, London, United Kingdom, December 1-3, 2021 . IEEE, 85–95
Anh Thai, Stefan Stojanov, Vijay Upadhya, and James M. Rehg. 2021 · 2021
Earlier work this paper cites.
NeuS: Learning Neural Implicit Surfaces by Volume Rendering for Multi-view Reconstruction. In Advances in Neural Information Processing Systems 34: Annual Conference on Neural Information Processing Systems 2021, NeurIPS 2021, December 6-14, 2021, virtual , Marc’Aurelio Ranzato, Alina Beygelzimer, Yann N. Dauphin, Percy Liang, and Jennifer Wortman Vaughan (Eds.). 27171–27183
Peng Wang, Lingjie Liu, Yuan Liu, Christian Theobalt, Taku Komura, and Wenping Wang. 2021a · 2021
Earlier work this paper cites.
PaMIR: Parametric Model-Conditioned Implicit Representation for Image-Based Human Reconstruction
Zerong Zheng, Tao Yu, Yebin Liu, and Qionghai Dai. 2022 · 2021
Earlier work this paper cites.
Pretrain, Self-train, Distill: A simple recipe for Supersizing 3D Reconstruction. In IEEE/CVF Conference on Computer Vision and Pattern Recognition, CVPR 2022, New Orleans, LA, USA, June 18-24, 2022 . IEEE, 3763–3772
Kalyan Vasudev Alwala, Abhinav Gupta, and Shubham Tulsiani. 2022 · 2022
Earlier work this paper cites.
AvatarCLIP: zero-shot text-driven generation and animation of 3D avatars
Fangzhou Hong, Mingyuan Zhang, Liang Pan, Zhongang Cai, Lei Yang, and Ziwei Liu. 2022 · 2022
Earlier work this paper cites.
Neural Wavelet-domain Diffusion for 3D Shape Generation. In SIGGRAPH Asia 2022 Conference Papers, SA 2022, Daegu, Republic of Korea, December 6-9, 2022 , Soon Ki Jung, Jehee Lee, and Adam W. Bargteil (Eds.). ACM, 24:1–24:9
Ka-Hei Hui, Ruihui Li, Jingyu Hu, and Chi-Wing Fu. 2022 · 2022
Earlier work this paper cites.
NeRF: representing scenes as neural radiance fields for view synthesis
Ben Mildenhall, Pratul P. Srinivasan, Matthew Tancik, Jonathan T. Barron, Ravi Ramamoorthi, and Ren Ng. 2022 · 2022
Earlier work this paper cites.
Point-E: A System for Generating 3D Point Clouds from Complex Prompts
Alex Nichol, Heewoo Jun, Prafulla Dhariwal, Pamela Mishkin, and Mark Chen. 2022 · 2022
Earlier work this paper cites.
VRoid Hub
VRoid. 2022 · 2022
Earlier work this paper cites.
Pixel2Mesh++: 3D Mesh Generation and Refinement From Multi-View Images
Chao Wen, Yinda Zhang, Chenjie Cao, Zhuwen Li, Xiangyang Xue, and Yanwei Fu. 2023 · 2022
Earlier work this paper cites.
ICON: Implicit Clothed humans Obtained from Normals. In IEEE/CVF Conference on Computer Vision and Pattern Recognition, CVPR 2022, New Orleans, LA, USA, June 18-24, 2022 . IEEE, 13286–13296
Yuliang Xiu, Jinlong Yang, Dimitrios Tzionas, and Michael J. Black. 2022 · 2022
Earlier work this paper cites.
LION: Latent Point Diffusion Models for 3D Shape Generation. In Advances in Neural Information Processing Systems 35: Annual Conference on Neural Information Processing Systems 2022, NeurIPS 2022, New Orleans, LA, USA, November 28 - December 9, 2022 , Sanmi Koyejo, S. Mohamed, A. Agarwal, Danielle Belgrave, K. Cho, and A. Oh (Eds.)
Xiaohui Zeng, Arash Vahdat, Francis Williams, Zan Gojcic, Or Litany, Sanja Fidler, and Karsten Kreis. 2022 · 2022
Earlier work this paper cites.
accurig, a software for automatic character rigging
actorcore. 2023 · 2023
Cited alongside, same era.
DreamAvatar: Text-and-Shape Guided 3D Human Avatar Generation via Diffusion Models
Yukang Cao, Yan-Pei Cao, Kai Han, Ying Shan, and Kwan-Yee K. Wong. 2023 · 2023
Cited alongside, same era.
Generating Texture for 3D Human Avatar from a Single Image using Sampling and Refinement Networks
Sihun Cha, Kwanggyoon Seo, Amirsaman Ashtari, and Junyong Noh. 2023 · 2023
Cited alongside, same era.
Fantasia3D: Disentangling Geometry and Appearance for High-quality Text-to-3D Content Creation
Rui Chen, Yongwei Chen, Ningxin Jiao, and Kui Jia. 2023a · 2023
Cited alongside, same era.
PAniC-3D: Stylized Single-view 3D Reconstruction from Portraits of Anime Characters. In IEEE/CVF Conference on Computer Vision and Pattern Recognition, CVPR 2023, Vancouver, BC, Canada, June 17-24, 2023 . IEEE, 21068–21077
Wonder3D: Single Image to 3D using Cross-Domain Diffusion
Xiaoxiao Long, Yuan-Chen Guo, Cheng Lin, Yuan Liu, Zhiyang Dou, Lingjie Liu, Yuexin Ma, Song-Hai Zhang, Marc Habermann, Christian Theobalt, and Wenping Wang. 2023 · 2023
Later among the works it cites.
RealFusion 360° Reconstruction of Any Object from a Single Image. In IEEE/CVF Conference on Computer Vision and Pattern Recognition, CVPR 2023, Vancouver, BC, Canada, June 17-24, 2023 . IEEE, 8446–8455
Luke Melas-Kyriazi, Iro Laina, Christian Rupprecht, and Andrea Vedaldi. 2023 · 2023
Later among the works it cites.
Latent-NeRF for Shape-Guided Generation of 3D Shapes and Textures. In IEEE/CVF Conference on Computer Vision and Pattern Recognition, CVPR 2023, Vancouver, BC, Canada, June 17-24, 2023 . IEEE, 12663–12673
Gal Metzer, Elad Richardson, Or Patashnik, Raja Giryes, and Daniel Cohen-Or. 2023 · 2023
Later among the works it cites.
DiffRF: Rendering-Guided 3D Radiance Field Diffusion. In IEEE/CVF Conference on Computer Vision and Pattern Recognition, CVPR 2023, Vancouver, BC, Canada, June 17-24, 2023 . IEEE, 4328–4338
Norman Müller, Yawar Siddiqui, Lorenzo Porzi, Samuel Rota Bulò, Peter Kontschieder, and Matthias Nießner. 2023 · 2023
alphaXiv searches the wider corpus for related work and actual follow-ups.
alphaXiv is searching for related work…
Shuhong Chen, Kevin Zhang, Yichun Shi, Heng Wang, Yiheng Zhu, Guoxian Song, Sizhe An, Janus Kristjansson, Xiao Yang, and Matthias Zwicker. 2023b · 2023
Cited alongside, same era.
Objaverse: A Universe of Annotated 3D Objects. In IEEE/CVF Conference on Computer Vision and Pattern Recognition, CVPR 2023, Vancouver, BC, Canada, June 17-24, 2023 . IEEE, 13142–13153
Matt Deitke, Dustin Schwenk, Jordi Salvador, Luca Weihs, Oscar Michel, Eli VanderBilt, Ludwig Schmidt, Kiana Ehsani, Aniruddha Kembhavi, and Ali Farhadi. 2023 · 2023
Cited alongside, same era.
NeRDi: Single-View NeRF Synthesis with Language-Guided Diffusion as General Image Priors. In IEEE/CVF Conference on Computer Vision and Pattern Recognition, CVPR 2023, Vancouver, BC, Canada, June 17-24, 2023 . IEEE, 20637–20647
Congyue Deng, Chiyu Max Jiang, Charles R. Qi, Xinchen Yan, Yin Zhou, Leonidas J. Guibas, and Dragomir Anguelov. 2023 · 2023
Cited alongside, same era.
HyperDiffusion: Generating Implicit Neural Fields with Weight-Space Diffusion
Ziya Erkoç, Fangchang Ma, Qi Shan, Matthias Nießner, and Angela Dai. 2023 · 2023
Cited alongside, same era.
warudo, a 3D virtual image live broadcast software
HakuyaLabs. 2023 · 2023
Cited alongside, same era.
EVA3D: Compositional 3D Human Generation from 2D Image Collections. In The Eleventh International Conference on Learning Representations, ICLR 2023, Kigali, Rwanda, May 1-5, 2023 . OpenReview.net
Fangzhou Hong, Zhaoxi Chen, Yushi Lan, Liang Pan, and Ziwei Liu. 2023a · 2023
Cited alongside, same era.
LRM: Large Reconstruction Model for Single Image to 3D
Yicong Hong, Kai Zhang, Jiuxiang Gu, Sai Bi, Yang Zhou, Difan Liu, Feng Liu, Kalyan Sunkavalli, Trung Bui, and Hao Tan. 2023b · 2023
Cited alongside, same era.
Animate Anyone: Consistent and Controllable Image-to-Video Synthesis for Character Animation
Li Hu, Xin Gao, Peng Zhang, Ke Sun, Bang Zhang, and Liefeng Bo. 2023 · 2023
Cited alongside, same era.
Later among the works it cites.
DreamFusion: Text-to-3D using 2D Diffusion. In The Eleventh International Conference on Learning Representations, ICLR 2023, Kigali, Rwanda, May 1-5, 2023 . OpenReview.net
Ben Poole, Ajay Jain, Jonathan T. Barron, and Ben Mildenhall. 2023 · 2023
Later among the works it cites.
Magic123: One Image to High-Quality 3D Object Generation Using Both 2D and 3D Diffusion Priors
Guocheng Qian, Jinjie Mai, Abdullah Hamdi, Jian Ren, Aliaksandr Siarohin, Bing Li, Hsin-Ying Lee, Ivan Skorokhodov, Peter Wonka, Sergey Tulyakov, and Bernard Ghanem. 2023 · 2023
Later among the works it cites.
DreamBooth3D: Subject-Driven Text-to-3D Generation. In IEEE/CVF International Conference on Computer Vision, ICCV 2023, Paris, France, October 1-6, 2023 . IEEE, 2349–2359
Amit Raj, Srinivas Kaza, Ben Poole, Michael Niemeyer, Nataniel Ruiz, Ben Mildenhall, Shiran Zada, Kfir Aberman, Michael Rubinstein, Jonathan T. Barron, Yuanzhen Li, and Varun Jampani. 2023 · 2023
Later among the works it cites.
DreamBooth: Fine Tuning Text-to-Image Diffusion Models for Subject-Driven Generation. In IEEE/CVF Conference on Computer Vision and Pattern Recognition, CVPR 2023, Vancouver, BC, Canada, June 17-24, 2023 . IEEE, 22500–22510
Nataniel Ruiz, Yuanzhen Li, Varun Jampani, Yael Pritch, Michael Rubinstein, and Kfir Aberman. 2023 · 2023
Later among the works it cites.
Zero123++: a Single Image to Consistent Multi-view Diffusion Base Model
Ruoxi Shi, Hansheng Chen, Zhuoyang Zhang, Minghua Liu, Chao Xu, Xinyue Wei, Linghao Chen, Chong Zeng, and Hao Su. 2023a · 2023
Later among the works it cites.
MVDream: Multi-view Diffusion for 3D Generation
Yichun Shi, Peng Wang, Jianglong Ye, Mai Long, Kejie Li, and Xiao Yang. 2023b · 2023
Later among the works it cites.
Make-It-3D: High-Fidelity 3D Creation from A Single Image with Diffusion Prior. In IEEE/CVF International Conference on Computer Vision, ICCV 2023, Paris, France, October 1-6, 2023 . IEEE, 22762–22772
Junshu Tang, Tengfei Wang, Bo Zhang, Ting Zhang, Ran Yi, Lizhuang Ma, and Dong Chen. 2023a · 2023
Later among the works it cites.
MVDiffusion: Enabling Holistic Multi-view Image Generation with Correspondence-Aware Diffusion
Shitao Tang, Fuyang Zhang, Jiacheng Chen, Peng Wang, and Yasutaka Furukawa. 2023b · 2023
Later among the works it cites.
Score Jacobian Chaining: Lifting Pretrained 2D Diffusion Models for 3D Generation. In IEEE/CVF Conference on Computer Vision and Pattern Recognition, CVPR 2023, Vancouver, BC, Canada, June 17-24, 2023 . IEEE, 12619–12629
Haochen Wang, Xiaodan Du, Jiahao Li, Raymond A. Yeh, and Greg Shakhnarovich. 2023a · 2023
Later among the works it cites.
ImageDream: Image-Prompt Multi-view Diffusion for 3D Generation
Peng Wang and Yichun Shi. 2023 · 2023
Later among the works it cites.
RODIN: A Generative Model for Sculpting 3D Digital Avatars Using Diffusion. In IEEE/CVF Conference on Computer Vision and Pattern Recognition, CVPR 2023, Vancouver, BC, Canada, June 17-24, 2023 . IEEE, 4563–4573
Tengfei Wang, Bo Zhang, Ting Zhang, Shuyang Gu, Jianmin Bao, Tadas Baltrusaitis, Jingjing Shen, Dong Chen, Fang Wen, Qifeng Chen, and Baining Guo. 2023c · 2023
Later among the works it cites.
ProlificDreamer: High-Fidelity and Diverse Text-to-3D Generation with Variational Score Distillation
Zhengyi Wang, Cheng Lu, Yikai Wang, Fan Bao, Chongxuan Li, Hang Su, and Jun Zhu. 2023b · 2023
Later among the works it cites.
Multiview Compressive Coding for 3D Reconstruction. In IEEE/CVF Conference on Computer Vision and Pattern Recognition, CVPR 2023, Vancouver, BC, Canada, June 17-24, 2023 . IEEE, 9065–9075
Chao-Yuan Wu, Justin Johnson, Jitendra Malik, Christoph Feichtenhofer, and Georgia Gkioxari. 2023a · 2023
Later among the works it cites.
OmniObject3D: Large-Vocabulary 3D Object Dataset for Realistic Perception, Reconstruction and Generation. In IEEE/CVF Conference on Computer Vision and Pattern Recognition, CVPR 2023, Vancouver, BC, Canada, June 17-24, 2023 . IEEE, 803–814
Tong Wu, Jiarui Zhang, Xiao Fu, Yuxin Wang, Jiawei Ren, Liang Pan, Wayne Wu, Lei Yang, Jiaqi Wang, Chen Qian, Dahua Lin, and Ziwei Liu. 2023b · 2023
Later among the works it cites.
ECON: Explicit Clothed humans Optimized via Normal integration. In IEEE/CVF Conference on Computer Vision and Pattern Recognition, CVPR 2023, Vancouver, BC, Canada, June 17-24, 2023 . IEEE, 512–523
Yuliang Xiu, Jinlong Yang, Xu Cao, Dimitrios Tzionas, and Michael J. Black. 2023 · 2023
Later among the works it cites.
IP-Adapter: Text Compatible Image Prompt Adapter for Text-to-Image Diffusion Models
Hu Ye, Jun Zhang, Sibo Liu, Xiao Han, and Wei Yang. 2023 · 2023
Later among the works it cites.
DreamSparse: Escaping from Plato’s Cave with 2D Frozen Diffusion Model Given Sparse Views
Paul Yoo, Jiaxian Guo, Yutaka Matsuo, and Shixiang Shane Gu. 2023 · 2023
Later among the works it cites.
3DShape2VecSet: A 3D Shape Representation for Neural Fields and Generative Diffusion Models
Biao Zhang, Jiapeng Tang, Matthias Nießner, and Peter Wonka. 2023b · 2023
Later among the works it cites.
AvatarVerse: High-quality & Stable 3D Avatar Creation from Text and Pose
Huichao Zhang, Bowen Chen, Hao Yang, Liao Qu, Xu Wang, Li Chen, Chao Long, Feida Zhu, Kang Du, and Min Zheng. 2023a · 2023
Later among the works it cites.
AvatarStudio: High-fidelity and Animatable 3D Avatar Creation from Text
Jianfeng Zhang, Xuanmeng Zhang, Huichao Zhang, Jun Hao Liew, Chenxu Zhang, Yi Yang, and Jiashi Feng. 2023c · 2023
Later among the works it cites.
Adding Conditional Control to Text-to-Image Diffusion Models
Lvmin Zhang and Maneesh Agrawala. 2023 · 2023
Later among the works it cites.