OpenVLA
Prismatic VLMアーキテクチャ上に構築されたオープンソースのVision-Language-Actionモデル。Open X-Embodimentデータセットで微調整されています。OpenVLAは画像と言語指示からロボット動作を予測します。オープンウェイトモデル(7Bパラメータ)として、研究コミュニティがVLA技術を研究、修正、構築することを可能にします。
Prismatic VLMアーキテクチャ上に構築されたオープンソースのVision-Language-Actionモデル。Open X-Embodimentデータセットで微調整されています。OpenVLAは画像と言語指示からロボット動作を予測します。オープンウェイトモデル(7Bパラメータ)として、研究コミュニティがVLA技術を研究、修正、構築することを可能にします。