Volver a VLA Models

Octo

Octo: Política de difusión de transformadores de código abierto para la manipulación de robots. 27M/93M parámetros, 800K trayectorias. Berkeley, Stanford, CMU, Google DeepMind.

[← Modelos]

Política generalista de robots de código abierto política de difusión basada en transformadores para la manipulación.

En general

Octo es una política de difusión basada en transformador entrenada en 800K trayectorias de robots de Open X-Embodiment. Apoya comandos de lenguaje o imágenes de objetivos, múltiples cámaras RGB y varios brazos de robots. Octo-Small (27M) y Octo-Base (93M) se pueden ajustar en horas en GPUs de consumo.

Arquitectura y escala

  • Octo-Pequeño 27M params, Octo-Base 93M params
  • 800K trayectorias desde el cuerpo X abierto
  • Condicionamiento del lenguaje o de la imagen objetivo
  • Multi-cámara, multi-robot fuera de la caja

Enlaces oficiales

  • octo-models.github.io Sitio del proyecto
  • github.com/octo-models/octo Código (MIT)
  • [Creo que es un poco más difícil de hacer que el equipo de la compañía sea capaz de hacer que el equipo de la compañía sea capaz de hacer que el equipo de la compañía sea capaz de hacer que el equipo de la compañía sea capaz de hacer que el equipo de la compañía sea capaz de hacer que el equipo de la compañía sea capaz de hacer que el equipo de la compañía sea capaz de hacer que el equipo de la compañía sea capaz de hacer que el equipo de la compañía sea capaz de hacer que el equipo de la compañía sea capaz de hacer que el equipo de la compañía sea capaz de hacer que el equipo de la compañía.

Citación

Consulte el sitio web del proyecto para BibTeX y referencias en papel.

Cada VLA aquí puede ser ajustado a sus propias demostraciones.

Recoge demos → Hardware que lo ejecuta → Corre una política →