返回VLA Models

国际VLA-M1

国际机器人:空间导向视觉语言行动框架.上海人工智能实验室,国际机器人. 71<unk>81%谷歌机器人,95.9% LIBERO.

对于一般主义机器人政策的空间指导视觉语言行动框架.

概述

通过二阶段的管道: (1) 在2.3M样本上进行空间定位预训练,以确定"何处采取行动"", (2) 空间指导行动后训练,以"如何采取行动".

标准标志

  • 谷歌机器人 71.7% (WidowX), 76.0% (VM), 80.7% (VA)
  • 利率95.9%
  • 对于SimplerEnv,+20.6%用于无形物体,

官方链接

  • 项目网站
  • 其他技术技术:技术技术,技术,技术,技术,技术,技术,技术,技术,技术,技术,技术等
  • T3) 模型和数据集

引用

查看项目网站,查看BibTeX和纸质参考.

任何VLA都能根据自己的演示进行调整.

收集演示 → 运行它的硬件 → 评分一个政策 →