DQN
Deep Q-Network — ein wertbasierter RL-Algorithmus, der ein neuronales Netzwerk verwendet, um die Aktions-Wert-Funktion Q(s,a) zu approximieren und Aktionen durch Maximierung von Q auszuwählen. DQN führte Experience Replay und Ziel-Netzwerke für stabiles Training ein. Obwohl primär für diskrete Aktionsräume (Atari-Spiele) verwendet, wurden DQN-Varianten für diskretisierte Roboter-Kontrolle angepasst.







