VLA Models(으)로 돌아가기

오토토

오ક્ટો: 로봇 조작을 위한 오픈소스 트랜스퍼머 전파 정책 27M/93M 매개 변수, 800K 궤도. 버클리, 스탠퍼드, CMU, 구글 딥마인드.

[← 모델]

오픈소스 일반 로봇 정책 조작을 위한 트랜스퍼머 기반의 전파 정책

전체적인 설명

Octo는 오픈 X-Embodiment에서 800K 로봇 궤도에 훈련된 트랜스포머 기반의 전파 정책입니다. 언어 명령이나 목표 이미지, 여러 RGB 카메라 및 다양한 로봇 팔을 지원합니다. Octo-Small (27M) 및 Octo-Base (93M) 는 소비자 GPU에서 몇 시간 내에 정밀 조정 할 수 있습니다.

건축 & 규모

  • 오크토-작은 27M 파람, 오크토-베이스 93M 파람
  • 800K 오픈 X-Embodyment의 궤도
  • 언어 또는 목표 이미지 조건화
  • 멀티 카메라, 멀티 로봇, 박스 밖으로

공식 링크

인용

BibTeX 및 논문 참조를 위한 프로젝트 사이트 참조.

여기 있는 모든 VLA는 여러분의 직접적인 시위에 맞춰 조정될 수 있습니다.

디모를 수집하라 → 하드웨어가 실행되는 것 → 정책 점수를 →