Glossaryに戻る

文脈条件付き制御ポリシー

Robot LearningPolicy

タスク固有の情報(現在のタスクID、目標記述、デモンストレーション埋め込み)をエンコードした文脈ベクトルを観測とともに受け取る制御ポリシー。文脈条件付けにより、単一の制御ポリシーが文脈に基づいて動作を切り替えることで複数のタスクに対応できる。タスクエンコーダー(言語、目標画像、少数ショットデモから得られる)が文脈ベクトルを提供する。

Related terms