Volver a Benchmarks

Google Robot de referencia

Google Robot Benchmark: 700+ tareas de manipulación en el mundo real. WidowX, multi-embodamiento. Evaluación de la tasa de éxito. RCSV.

[← Indicadores de referencia]

Evaluación de manipulación en el mundo real. 700 tareas, múltiples encarnaciones de robots.

En general

El Google Robot Benchmark evalúa las políticas de los robots físicos reales en más de 700 tareas. Apoya WidowX y otras realizaciones. Las métricas incluyen tasa de éxito, rendimiento multi-tarefa y conexión al suelo. Se utiliza para evaluar OpenVLA, RT-X y modelos relacionados.

Resultados clave

  • InternVLA-M1: 71,7% (WidowX), 7681% (otras realizaciones)
  • OpenVLA: superó RT-2-X en un 16,5% en 29 tareas

Relacionado

  • [BridgeData] T1) Datos de WidowX
  • OpenVLA Evaluación del modelo

Los puntos de referencia comparan las políticas en sim; nuestro bucle de evaluación las califica en plataformas físicas.

RCSV Eval → Datos de formación de licencia →