DQN
Deep Q-Network — алгоритм обучения с подкреплением на основе значений, который использует нейронную сеть для аппроксимации функции действие-значение Q(s,a), выбирая действия путём максимизации Q. DQN представил воспроизведение опыта и целевые сети для стабильного обучения. Хотя в основном используется для дискретных пространств действий (игры Atari), варианты DQN были адаптированы для дискретизированного управления роботом.







