Voltar para Glossary

Política Estocástica

Robot LearningRLPolicy

Uma política que produz uma distribuição de probabilidade sobre ações (em vez de uma única ação determinística), permitindo exploração e tratamento de incerteza aleatória. Políticas gaussianas (média + covariância diagonal) são padrão em aprendizado por gradiente de política. Políticas de difusão e políticas de fluxo normalizador estendem para distribuições de ação mais complexas. Políticas estocásticas são necessárias para aprendizado de máxima entropia (SAC).

Related terms