Fetching the paper…

DeepAveragers: Offline Reinforcement Learning by Solving Derived Non-Parametric MDPs · Around