遊びからの学習
非構造化された遊びデータからの模倣学習。人間がテレオペレーションでロボットを探索させ、特定のタスクに従わずに環境と相互作用します。遊びデータは収集が安価で(タスク指定が不要)、多様です。PLAY-LMPおよび他のLfPアルゴリズムは遊びデータセットから再利用可能なスキルライブラリを抽出し、目標条件付きの下流タスク学習を可能にします。
非構造化された遊びデータからの模倣学習。人間がテレオペレーションでロボットを探索させ、特定のタスクに従わずに環境と相互作用します。遊びデータは収集が安価で(タスク指定が不要)、多様です。PLAY-LMPおよび他のLfPアルゴリズムは遊びデータセットから再利用可能なスキルライブラリを抽出し、目標条件付きの下流タスク学習を可能にします。