国际VLA-M1
国际机器人:空间导向视觉语言行动框架.上海人工智能实验室,国际机器人. 71<unk>81%谷歌机器人,95.9% LIBERO.
对于一般主义机器人政策的空间指导视觉语言行动框架.
概述
通过二阶段的管道: (1) 在2.3M样本上进行空间定位预训练,以确定"何处采取行动"", (2) 空间指导行动后训练,以"如何采取行动".
标准标志
- 谷歌机器人 71.7% (WidowX), 76.0% (VM), 80.7% (VA)
利率95.9% - 对于SimplerEnv,+20.6%用于无形物体,
官方链接
- 项目网站
- 其他技术技术:技术技术,技术,技术,技术,技术,技术,技术,技术,技术,技术,技术等
T3 ) 模型和数据集
引用
查看项目网站,查看BibTeX和纸质参考.
任何VLA都能根据自己的演示进行调整.







