Deployment-efficient reinforcement learning via model-based offline optimization1, 2021·Tatsuya Matsushima,Hiroki Furuta,Yutaka Matsuo,Ofir Nachum,Shixiang Gu· 0 分で読める 引用publication最終更新 1, 2021 ← Co-adaptation of algorithmic and implementational innovations in inference-based deep reinforcement learning 1, 2021Policy information capacity: Information-theoretic measure for task complexity in deep reinforcement learning 1, 2021 →