Policy information capacity: Information-theoretic measure for task complexity in deep reinforcement learning1, 2021·Hiroki Furuta,Tatsuya Matsushima,Tadashi Kozuno,Yutaka Matsuo,Sergey Levine,Ofir Nachum,Shixiang Shane Gu· 0 分で読める 引用publication最終更新 1, 2021 ← Deployment-efficient reinforcement learning via model-based offline optimization 1, 2021Tool as embodiment for recursive manipulation 1, 2021 →