Voltar para Glossary

Processo de Decisão de Markov

MathRL

Um framework matemático para tomada de decisão sequencial sob incerteza: uma tupla (S, A, P, R, γ) de estados, ações, probabilidades de transição, função de recompensa e fator de desconto. Algoritmos de RL aprendem políticas de controle que maximizam o retorno esperado descontado em um MDP. Manipulação e locomoção robótica são modeladas como MDPs, onde a política de controle mapeia estados para ações.

Related terms