段階的な教示による陳列動作の模倣学習1, 2022·山根広暉,野口裕貴,青山裕良,松嶋達也,岡田領,佐野元紀,松尾豊· 0 分で読める 引用publication最終更新 1, 2022 ← 制御方策の学習アルゴリズムにおける時間の離散化の影響と連続時間への拡張に向けた考察 1, 2022Co-adaptation of algorithmic and implementational innovations in inference-based deep reinforcement learning 1, 2021 →