DQN
Deep Q-Network — 行動価値関数 Q(s,a) を近似するニューラルネットワークを使用する価値ベースの強化学習アルゴリズムで、Q を最大化することでアクションを選択します。DQN は経験リプレイとターゲットネットワークを導入し、安定した学習を実現しました。主に離散アクション空間(Atari ゲーム)に使用されていますが、DQN の変種はロボット制御の離散化に適応されています。
Deep Q-Network — 行動価値関数 Q(s,a) を近似するニューラルネットワークを使用する価値ベースの強化学習アルゴリズムで、Q を最大化することでアクションを選択します。DQN は経験リプレイとターゲットネットワークを導入し、安定した学習を実現しました。主に離散アクション空間(Atari ゲーム)に使用されていますが、DQN の変種はロボット制御の離散化に適応されています。