Retour à Glossary

Politique autorégressive

Robot LearningPolicy

Une architecture de contrôle qui génère les actions multidimensionnelles une dimension à la fois, en conditionnant chaque dimension suivante sur les dimensions précédemment générées. Les politiques autorégressives peuvent modéliser les distributions d'actions complexes et multimodales de manière plus fidèle que les politiques gaussiennes. Le compromis est une inférence plus lente en raison de la génération séquentielle. Utilisée dans BeT (Behavior Transformers) et certaines variantes de Diffusion Policy.

Related terms