OpenVLA
Ein Open-Source-Vision-Language-Action-Modell, das auf der Prismatic-VLM-Architektur aufgebaut und auf dem Open X-Embodiment-Datensatz feinabgestimmt ist. OpenVLA sagt diskretisierte Roboteractions aus Bildern und Sprachanweisungen voraus. Als Open-Weights-Modell (7B Parameter) ermöglicht es der Forschungsgemeinschaft, VLA-Technologie zu studieren, zu modifizieren und darauf aufzubauen, ohne proprietäre Einschränkungen.







