OpenVLA
Un modèle Vision-Langage-Action open-source construit sur l'architecture VLM Prismatic, affiné sur l'ensemble de données Open X-Embodiment. OpenVLA prédit des actions robotiques discrétisées à partir d'images et d'instructions en langage naturel. En tant que modèle à poids ouverts (7B paramètres), il permet à la communauté de recherche d'étudier, modifier et construire sur la technologie VLA sans restrictions propriétaires.







