Назад к Glossary

Авторегрессивная политика управления

Robot LearningPolicy

Архитектура политики управления, которая генерирует многомерные действия по одному измерению за раз, обусловливая каждое последующее измерение ранее сгенерированными. Авторегрессивные политики управления могут моделировать сложные, мультимодальные распределения действий более точно, чем гауссовские политики. Компромисс заключается в более медленном выводе из-за последовательной генерации. Используется в BeT (Behavior Transformers) и некоторых вариантах Diffusion Policy.

Related terms