Planning with diffusion for flexible behavior synthesis
Michael Janner, Yilun Du, Joshua Tenenbaum, and Sergey Levine · 2022
Later among the works it cites.
Dall-e-bot: Introducing web-scale diffusion models to robotics
Ivan Kapelyukh, Vitalis Vosylius, and Edward Johns · 2022
Later among the works it cites.
Soft truncation: A universal training technique of score-based diffusion model for high precision score estimation
Dongjun Kim, Seungjae Shin, Kyungwoo Song, Wanmo Kang, and Il-Chul Moon · 2022
Later among the works it cites.
Structdiffusion: Object-centric diffusion for semantic rearrangement of novel objects
Weiyu Liu, Tucker Hermans, Sonia Chernova, and Chris Paxton · 2022
Later among the works it cites.
Trajectory balance: Improved credit assignment in gflownets
Nikolay Malkin, Moksh Jain, Emmanuel Bengio, Chen Sun, and Yoshua Bengio · 2022
Later among the works it cites.
What matters in language conditioned robotic imitation learning over unstructured data
Oier Mees, Lukas Hermann, and Wolfram Burgard · 2022
Later among the works it cites.
A generalist agent
Scott Reed, Konrad Zolna, Emilio Parisotto, Sergio Gómez Colmenarejo, Alexander Novikov, Gabriel Barth-maron, Mai Giménez, Yury Sulsky, Jackie Kay, Jost Tobias Springenberg, Tom Eccles, Jake Bruce, Ali Razavi, Ashley Edwards, Nicolas Heess, Yutian Chen, Raia Hadsell, Oriol Vinyals, Mahyar Bordbar, and Nando de Freitas · 2022
Later among the works it cites.
Behavior transformers: Cloning k k modes with one stone
Nur Muhammad Shafiullah, Zichen Cui, Ariuntuya Arty Altanzaya, and Lerrel Pinto · 2022
Later among the works it cites.
Hierarchical policies for cluttered-scene grasping with latent plans
Lirui Wang, Xiangyun Meng, Yu Xiang, and Dieter Fox · 2022
Later among the works it cites.
Convergence in kl divergence of the inexact langevin algorithm with application to score-based generative models
Original
Andre Wibisono and Kaylee Yingxi Yang · 2022
Later among the works it cites.
Diffusion models: A comprehensive survey of methods and applications
Original
Ling Yang, Zhilong Zhang, Yang Song, Shenda Hong, Runsheng Xu, Yue Zhao, Yingxia Shao, Wentao Zhang, Bin Cui, and Ming-Hsuan Yang · 2022
Later among the works it cites.
Fast sampling of diffusion models with exponential integrator
Chen Yongxin Zhang, Qinsheng · 2022
Later among the works it cites.
Is conditional generative modeling all you need for decision-making?
Anurag Ajay, Yilun Du, Abhi Gupta, Joshua Tenenbaum, Tommi Jaakkola, and Pulkit Agrawal · 2023
Closest in time.
Edgi: Equivariant diffusion for planning with embodied agents
Johann Brehmer, Joey Bose, Pim De Haan, and Taco Cohen · 2023
Closest in time.
Diffusion policy: Visuomotor policy learning via action diffusion
Original
Cheng Chi, Siyuan Feng, Yilun Du, Zhenjia Xu, Eric Cousineau, Benjamin Burchfiel, and Shuran Song · 2023
Closest in time.
From play to policy: Conditional behavior generation from uncurated robot data
Zichen Jeff Cui, Yibin Wang, Nur Muhammad, Lerrel Pinto, et al · 2023
Closest in time.
Arc-actor residual critic for adversarial imitation learning
Ankur Deka, Changliu Liu, and Katia P Sycara · 2023
Closest in time.
Preference transformer: Modeling human preferences using transformers for rl
Changyeon Kim, Jongjin Park, Jinwoo Shin, Honglak Lee, Pieter Abbeel, and Kimin Lee · 2023
Closest in time.
Contrastive decision transformers
Sachin G Konan, Esmaeil Seraj, and Matthew Gombolay · 2023
Closest in time.
Convergence of score-based generative modeling for general data distributions
Holden Lee, Jianfeng Lu, and Yixin Tan · 2023
Closest in time.
Adaptdiffuser: Diffusion models as adaptive self-evolving planners
Original
Zhixuan Liang, Yao Mu, Mingyu Ding, Fei Ni, Masayoshi Tomizuka, and Ping Luo · 2023
Closest in time.
Reorientdiff: Diffusion model based reorientation for object manipulation
Original
Utkarsh A Mishra and Yongxin Chen · 2023
Closest in time.
Stochastic generative flow networks
Original
Ling Pan, Dinghuai Zhang, Moksh Jain, Longbo Huang, and Yoshua Bengio · 2023
Closest in time.
Imitating human behaviour with diffusion models
Tim Pearce, Tabish Rashid, Anssi Kanervisto, Dave Bignell, Mingfei Sun, Raluca Georgescu, Sergio Valcarcel Macua, Shan Zheng Tan, Ida Momennejad, Katja Hofmann, et al · 2023
Closest in time.
Model-based adversarial imitation learning as online fine-tuning
Rafael Rafailov, Victor Kolev, Kyle Beltran Hatch, John D Martin, Mariano Phielipp, Jiajun Wu, and Chelsea Finn · 2023
Closest in time.
Goal-conditioned imitation learning using score-based diffusion policies
Original
Moritz Reuss, Maximilian Li, Xiaogang Jia, and Rudolf Lioutikov · 2023
Closest in time.
Latent plans for task-agnostic offline reinforcement learning
Erick Rosete-Beas, Oier Mees, Gabriel Kalweit, Joschka Boedecker, and Wolfram Burgard · 2023
Closest in time.
Adversarial imitation learning with preferences
Aleksandar Taranovic, Andras Gabor Kupcsik, Niklas Freymuth, and Gerhard Neumann · 2023
Closest in time.
Se(3)-diffusionfields: Learning cost functions for joint grasp and motion optimization through diffusion
Julen Urain, Niklas Funk, Georgia Chalvatzaki, and Jan Peters · 2023
Closest in time.
Diffusion policies as an expressive policy class for offline reinforcement learning
Zhendong Wang, Jonathan J Hunt, and Mingyuan Zhou · 2023
Closest in time.
Foundation models for decision making: Problems, methods, and opportunities
Original
Sherry Yang, Ofir Nachum, Yilun Du, Jason Wei, Pieter Abbeel, and Dale Schuurmans · 2023
Closest in time.