Glossary(으)로 돌아가기

자기회귀 제어정책

Robot LearningPolicy

다차원 액션을 한 번에 하나의 차원씩 생성하는 제어정책 아키텍처로, 각 후속 차원을 이전에 생성된 차원들에 조건화합니다. 자기회귀 제어정책은 가우시안 제어정책보다 복잡한 다중 양식 액션 분포를 더 충실하게 모델링할 수 있습니다. 순차 생성으로 인한 느린 추론이 트레이드오프입니다. BeT(Behavior Transformers)와 일부 Diffusion Policy 변형에서 사용됩니다.

Related terms