OpenVLA
Prismatic VLM आर्किटेक्चर पर निर्मित एक खुला स्रोत Vision-Language-Action मॉडल, Open X-Embodiment डेटासेट पर सूक्ष्म-ट्यून किया गया। OpenVLA छवियों और भाषा निर्देशों से विवेकशील रोबोट क्रियाओं की भविष्यवाणी करता है। एक खुले-वजन मॉडल (7B पैरामीटर) के रूप में, यह अनुसंधान समुदाय को VLA प्रौद्योगिकी का अध्ययन, संशोधन, और निर्माण करने में सक्षम बनाता है बिना मालिकाना प्रतिबंधों के।







