Benchmarksに戻る

ローズ・ベンチ

RLBench: PyRepシミュレーションにおける100以上の操作作業. VLA評価基準. BridgeVLA 88.2%, InternVLA. RCSV.

[←ベンチマーク]

PyRepで100以上の操作作業.VLAと政策評価のための標準基準.

概要

RLBench は PyRep (CoppeliaSim) のシミュレーション環境で大規模な操作作業を提供します.作業にはピックプレス,スタッキング,開箱などが含まれます.視言語行動モデルとビジョモーターポリシーを評価するために広く使用されています.

重要な結果 (最近の結果)

  • ブリージ・VLA: 88.2%の成功
  • 副セットで95%+

公式リンク

標準値は sim でポリシーを比較し,私たちの eval loop は物理的なリグで評価します.

RCSV Eval → ライセンス訓練データ →