Voltar para Glossary

Política Autorregressiva

Robot LearningPolicy

Uma arquitetura de política de controle que gera ações multidimensionais uma dimensão por vez, condicionando cada dimensão subsequente nas geradas anteriormente. Políticas autorregressivas podem modelar distribuições de ações complexas e multimodais de forma mais fiel do que políticas gaussianas. O trade-off é a inferência mais lenta devido à geração sequencial. Usada em BeT (Behavior Transformers) e algumas variantes de Diffusion Policy.

Related terms