DQN
Deep Q-Network — um algoritmo RL baseado em valor que usa uma rede neural para aproximar a função de valor de ação Q(s,a), selecionando ações maximizando Q. DQN introduziu replay de experiência e redes alvo para treinamento estável. Embora seja usado principalmente para espaços de ação discretos (jogos Atari), variantes de DQN foram adaptadas para controle de robô discretizado.







