RL 벤치
RLBench: PyRep 시뮬레이션에서 100개 이상의 조작 작업. VLA 평가 기준. BridgeVLA 88.2%, InternVLA. RCSV.
[← 벤치마크]
PyRep에서 100개 이상의 조작 작업. VLA 및 정책 평가의 표준 기준.
전체적인 설명
RLBench는 PyRep (CoppeliaSim) 시뮬레이션 환경에서 광범위한 조작 작업을 제공합니다. 작업에는 픽플레이스, 스택, 드래스 오픈 등이 포함됩니다. 시각 언어 행동 모델 및 시각모터 정책을 평가하는 데 널리 사용됩니다.
주요 결과 (최근)
- 브리지VLA: 88.2%의 성공
- InternVLA-M1: 하위 집합에서 95%+
공식 링크
- github.com/stepjam/RLBench
코드 & 작업
벤치마크는 sim에서 정책을 비교하고, 우리의 평가 루프는 물리적인 기구에서 점수를 제공합니다.







