机器人
机器人操作的基于OpenFlamingo的视觉语言模型. 拜特丹斯,清华,SJTU,NUS. MIT,拥抱面孔.
视觉语言基础模型作为有效的机器人模仿器.
概述
基于OpenFlamingo,RoboFlamingo将单步视觉语言理解与一个明确的政策负责人结合起来,用于连续机器人控制.通过模仿学习进行了精细调节.可在单个GPU服务器上进行训练.
建筑与性能
- 开放式菌脊柱 (MPT-3B,4B,9B变体)
- 政策负责人,以后续决策
- 强的CALVIN基准
- 开放循环控制,资源资源低的部署
官方链接
引用
查看项目网站,查看BibTeX和纸质参考.
任何VLA都能根据自己的演示进行调整.
收集演示 → 运行它的硬件 → 评分一个政策 →