松嶋 達也
松嶋 達也
経歴
実績
リソース
お問い合わせ
日本語
日本語
English
Ofir Nachum
最新
Deployment-efficient reinforcement learning via model-based offline optimization
Policy information capacity: Information-theoretic measure for task complexity in deep reinforcement learning
引用
×