返回Glossary

上下文条件化策略

Robot LearningPolicy

一种接收编码任务特定信息(当前任务ID、目标描述、演示嵌入)的上下文向量的控制策略,与观测一起输入。上下文条件化使单个策略能够通过根据上下文切换行为来处理多个任务。任务编码器(来自语言、目标图像或少样本演示)提供上下文向量。

Related terms