OpenVLA
Prismatic VLM 아키텍처를 기반으로 하고 Open X-Embodiment 데이터셋으로 미세 조정된 오픈소스 Vision-Language-Action 모델입니다. OpenVLA는 이미지와 언어 지시로부터 이산화된 로봇 동작을 예측합니다. 오픈 가중치 모델(70억 매개변수)로서, 연구 커뮤니티가 독점적 제한 없이 VLA 기술을 연구, 수정 및 기반으로 구축할 수 있게 합니다.
Prismatic VLM 아키텍처를 기반으로 하고 Open X-Embodiment 데이터셋으로 미세 조정된 오픈소스 Vision-Language-Action 모델입니다. OpenVLA는 이미지와 언어 지시로부터 이산화된 로봇 동작을 예측합니다. 오픈 가중치 모델(70억 매개변수)로서, 연구 커뮤니티가 독점적 제한 없이 VLA 기술을 연구, 수정 및 기반으로 구축할 수 있게 합니다.