Glossaryに戻る

IQL

RL

Implicit Q-Learning — 期待値回帰目的関数を用いて分布外の行動でQ関数をクエリすることを回避するオフライン強化学習アルゴリズム。IQLはCQLの明示的な保守性なしに強力なオフライン強化学習性能を達成し、実装とチューニングがより簡単である。デモンストレーションデータで訓練されたロボット操作タスクで人気が高い。

Related terms