Google Robot de referencia
Google Robot Benchmark: 700+ tareas de manipulación en el mundo real. WidowX, multi-embodamiento. Evaluación de la tasa de éxito. RCSV.
[← Indicadores de referencia]
Evaluación de manipulación en el mundo real. 700 tareas, múltiples encarnaciones de robots.
En general
El Google Robot Benchmark evalúa las políticas de los robots físicos reales en más de 700 tareas. Apoya WidowX y otras realizaciones. Las métricas incluyen tasa de éxito, rendimiento multi-tarefa y conexión al suelo. Se utiliza para evaluar OpenVLA, RT-X y modelos relacionados.
Resultados clave
- InternVLA-M1: 71,7% (WidowX), 76
81% (otras realizaciones) - OpenVLA: superó RT-2-X en un 16,5% en 29 tareas
Relacionado
- [BridgeData]
T1 ) Datos de WidowX - OpenVLA
Evaluación del modelo
Los puntos de referencia comparan las políticas en sim; nuestro bucle de evaluación las califica en plataformas físicas.







