返回VLA Models

机器人

机器人操作的基于OpenFlamingo的视觉语言模型. 拜特丹斯,清华,SJTU,NUS. MIT,拥抱面孔.

视觉语言基础模型作为有效的机器人模仿器.

概述

基于OpenFlamingo,RoboFlamingo将单步视觉语言理解与一个明确的政策负责人结合起来,用于连续机器人控制.通过模仿学习进行了精细调节.可在单个GPU服务器上进行训练.

建筑与性能

  • 开放式菌脊柱 (MPT-3B,4B,9B变体)
  • 政策负责人,以后续决策
  • 的CALVIN基准
  • 开放循环控制,资源资源低的部署

官方链接

  • 项目网站

引用

查看项目网站,查看BibTeX和纸质参考.

任何VLA都能根据自己的演示进行调整.

收集演示 → 运行它的硬件 → 评分一个政策 →