ローズ・ベンチ
RLBench: PyRepシミュレーションにおける100以上の操作作業. VLA評価基準. BridgeVLA 88.2%, InternVLA. RCSV.
[←ベンチマーク]
PyRepで100以上の操作作業.VLAと政策評価のための標準基準.
概要
RLBench は PyRep (CoppeliaSim) のシミュレーション環境で大規模な操作作業を提供します.作業にはピックプレス,スタッキング,開箱などが含まれます.視言語行動モデルとビジョモーターポリシーを評価するために広く使用されています.
重要な結果 (最近の結果)
- ブリージ・VLA: 88.2%の成功
- 副セットで95%+
公式リンク
- github.com/stepjam/RLBench
コード&タスク
標準値は sim でポリシーを比較し,私たちの eval loop は物理的なリグで評価します.







