Fetching the paper…
Reading the bibliography…
Reinforcement learning (RL) has become the de facto standard practice for sequential decision-making problems by improving future acting policies with feedback.
Visualbert: A simple and performant baseline for vision and language
Li, L. H · 1908
Earlier work this paper cites.
A theoretical model of second language learning 1
Bialystok, E · 1978
Earlier work this paper cites.
Policy gradient methods for reinforcement learning with function approximation
Sutton, R. S · 1999
Earlier work this paper cites.
Planning as heuristic search
Bonet, B · 2001
Earlier work this paper cites.
The ff planning system: Fast plan generation through heuristic search
Hoffmann, J · 2001
Earlier work this paper cites.
Lynch, C · 2005
Earlier work this paper cites.
Language conditioned imitation learning over unstructured data
Lynch, C · 2005
Earlier work this paper cites.
Grounding language to autonomously-acquired skills via goal generation
Akakzia, A · 2006
Earlier work this paper cites.
Alfworld: Aligning text and embodied environments for interactive learning
Shridhar, M · 2010
Earlier work this paper cites.
Playing atari with deep reinforcement learning
Mnih, V · 2013
Earlier work this paper cites.
Guided search for task and motion plans using learned heuristics
Chitnis, R · 2016
Earlier work this paper cites.
A unified view of entropy-regularized markov decision processes
Neu, G · 2017
Earlier work this paper cites.
Language as an abstraction for hierarchical deep reinforcement learning
Jiang, Y · 2019
Earlier work this paper cites.
Vilbert: Pretraining task-agnostic visiolinguistic representations for vision-and-language tasks
Lu, J · 2019
Earlier work this paper cites.
Evaluating large language models trained on code
Chen, M · 2021
Earlier work this paper cites.
Fast active learning for pure exploration in reinforcement learning
Ménard, P · 2021
Earlier work this paper cites.
Learning transferable visual models from natural language supervision
Radford, A · 2021
Earlier work this paper cites.
Skill induction and planning with latent language
Sharma, P · 2021
Cited alongside, same era.
Embodied bert: A transformer model for embodied, language-guided visual task completion
Suglia, A · 2021
Cited alongside, same era.
Do as i can, not as i say: Grounding language in robotic affordances
Ahn, M · 2022
Cited alongside, same era.
Reinforcement learning for classical planning: Viewing heuristics as dense reward generators
Gehring, C · 2022
Cited alongside, same era.
Language models as zero-shot planners: Extracting actionable knowledge for embodied agents
Huang, W · 2022
Cited alongside, same era.
Starcoder: may the source be with you!
Li, R · 2023
Later among the works it cites.
Code as policies: Language model programs for embodied control
Liang, J · 2023
Later among the works it cites.
Text2motion: From natural language instructions to feasible plans
Lin, K · 2023
Later among the works it cites.
Eureka: Human-level reward design via coding large language models
Ma, Y. J · 2023
Later among the works it cites.
Dissociating language and thought in large language models: a cognitive perspective
Mahowald, K · 2023
Later among the works it cites.
alphaXiv searches the wider corpus for related work and actual follow-ups.
alphaXiv is searching for related work…
Pre-trained language models for interactive decision-making
Li, S · 2022
Cited alongside, same era.
Can wikipedia help offline reinforcement learning?
Reid, M · 2022
Cited alongside, same era.
Chain-of-thought prompting elicits reasoning in large language models
Wei, J · 2022
Cited alongside, same era.
React: Synergizing reasoning and acting in language models
Yao, S · 2022
Cited alongside, same era.
Conservative dual policy optimization for efficient model-based reinforcement learning
Zhang, S · 2022
Cited alongside, same era.
Asking before action: Gather information in embodied decision making with language models
Chen, X · 2023
Cited alongside, same era.
Palm-e: An embodied multimodal language model
Driess, D · 2023
Cited alongside, same era.
Think before you act: Unified policy for interleaving language reasoning with actions
Mezghani, L · 2023
Later among the works it cites.
Understanding the capabilities of large language models for automated planning
Pallagani, V · 2023
Later among the works it cites.
Mathematical discoveries from program search with large language models
Romera-Paredes, B · 2023
Later among the works it cites.
Code llama: Open foundation models for code
Roziere, B · 2023
Later among the works it cites.
Algorithm of thoughts: Enhancing exploration of ideas in large language models
Sel, B · 2023
Later among the works it cites.
Reflexion: Language agents with verbal reinforcement learning
Shinn, N · 2023
Later among the works it cites.
Generalized planning in pddl domains with pretrained large language models
Silver, T · 2023
Later among the works it cites.
Adaplanner: Adaptive planning from feedback with language models
Sun, H · 2023
Later among the works it cites.
Translating natural language to planning goals with large-language models
Xie, Y · 2023
Later among the works it cites.
Plan4mc: Skill reinforcement learning and planning for open-world minecraft tasks
Yuan, H · 2023
Later among the works it cites.
Cumulative reasoning with large language models
Zhang, Y · 2023
Later among the works it cites.