Benchmarks(으)로 돌아가기

구글 로봇 벤치마크

구글 로봇 벤치마크: 700+ 실세계 조작 작업. WidowX, 다중 인체. 성공률 평가. RCSV.

[← 벤치마크]

실제 세계 조작 평가 700개 이상의 작업, 여러 로봇 구현

전체적인 설명

구글 로봇 벤치마크는 700개 이상의 작업에 걸쳐 실제 물리 로봇에 대한 정책을 평가합니다. WidowX 및 기타 구현을 지원합니다. 측정은 성공률, 다 작업 성능 및 언어 지형을 포함한다. OpenVLA, RT-X 및 관련 모델을 평가하는 데 사용됩니다.

주요 결과

  • InternVLA-M1: 71.7% (WidowX), 7681% (다른 실시예)
  • OpenVLA: 29개의 작업에서 RT-2-X보다 16.5% 더 좋은 성능을 발휘한다

관련

  • [브리지데이터]T1) WidowX 데이터 세트
  • OpenVLA 모델 평가

벤치마크는 sim에서 정책을 비교하고, 우리의 평가 루프는 물리적인 기구에서 점수를 제공합니다.

RCSV Eval → 허락 교육 자료 →