OpenVLA
Um modelo Vision-Language-Action de código aberto construído na arquitetura VLM Prismatic, ajustado fino no conjunto de dados Open X-Embodiment. OpenVLA prediz ações robóticas discretizadas a partir de imagens e instruções em linguagem natural. Como um modelo de pesos abertos (7B parâmetros), permite que a comunidade de pesquisa estude, modifique e construa sobre a tecnologia VLA sem restrições proprietárias.







