カルビン
言語とビジョンから作動を編成する 言語による操作基準の長視線 ロボフラミンゴ RCSV
[←ベンチマーク]
言語とビジョンからのアクションを構成 長い視線で言語によって調整された操作
概要
カルヴィンは,長時間における言語による操作を評価する.エージェントは自然言語の指示から複数のスキルを構成しなければならない.シミュレーションに基づく.ロボフラミンゴおよびその他のVLMベースの政策は強力なパフォーマンスを示しています.
公式リンク
- github.com/mees/calvin
コード&データセット
標準値は sim でポリシーを比較し,私たちの eval loop は物理的なリグで評価します.







