Zurück zu VLA Models

Octo

Octo: Open-Source Transformer Diffusion Policy für Robotermanipulation. 27M/93M Parameter, 800K Bahnen. Berkeley, Stanford, CMU, Google DeepMind.

[← Modelle]

Open-Source Generalist Robot Policy Transformator-basierte Diffusionspolitik für Manipulation.

Überblick

Octo ist eine Transformator-basierte Diffusionspolitik, die auf 800K Roboter-Trajektorien von Open X-Embodiment ausgebildet wurde. Es unterstützt Sprachbefehle oder Zielbilder, mehrere RGB-Kameras und verschiedene Roboterarme. Octo-Small (27M) und Octo-Base (93M) können in Stunden auf Konsum-GPUs feine abgestimmt werden.

Architektur und Maßstab

  • Octo-Small 27 M Param, Octo-Base 93 M Param
  • 800K Bahnen von Open X-Embodiment
  • Sprache- oder Zielbilderkonditionierung
  • Mehrkamera, mehrroboter aus der box

Offizielle Verbindungen

Zitat

Siehe die Projektseite für BibTeX und Papierreferenzen.

Jeder VLA hier kann auf Ihre eigenen Demonstrationen abgestimmt werden.

Sammeln Sie Demo → Hardware, das es läuft → Score eine Politik →