返回Glossary

自回归控制策略

Robot LearningPolicy

一种控制策略架构,每次生成一个维度的多维动作,每个后续维度都以先前生成的维度为条件。自回归策略能比高斯策略更忠实地建模复杂的多模态动作分布。权衡是推理速度较慢,因为需要顺序生成。用于 BeT(行为 Transformer)和某些扩散策略变体。

Related terms