구글 로봇 벤치마크
구글 로봇 벤치마크: 700+ 실세계 조작 작업. WidowX, 다중 인체. 성공률 평가. RCSV.
[← 벤치마크]
실제 세계 조작 평가 700개 이상의 작업, 여러 로봇 구현
전체적인 설명
구글 로봇 벤치마크는 700개 이상의 작업에 걸쳐 실제 물리 로봇에 대한 정책을 평가합니다. WidowX 및 기타 구현을 지원합니다. 측정은 성공률, 다 작업 성능 및 언어 지형을 포함한다. OpenVLA, RT-X 및 관련 모델을 평가하는 데 사용됩니다.
주요 결과
- InternVLA-M1: 71.7% (WidowX), 76
81% (다른 실시예) - OpenVLA: 29개의 작업에서 RT-2-X보다 16.5% 더 좋은 성능을 발휘한다
관련
- [브리지데이터]
T1 ) WidowX 데이터 세트 - OpenVLA
모델 평가
벤치마크는 sim에서 정책을 비교하고, 우리의 평가 루프는 물리적인 기구에서 점수를 제공합니다.







