DQN
Deep Q-Network — un algorithme RL basé sur la valeur qui utilise un réseau de neurones pour approximer la fonction de valeur d'action Q(s,a), en sélectionnant les actions en maximisant Q. DQN a introduit la relecture d'expérience et les réseaux cibles pour un entraînement stable. Bien que principalement utilisé pour les espaces d'action discrets (jeux Atari), les variantes de DQN ont été adaptées pour le contrôle robotique discrétisé.







