칼빈
언어와 시력에서 작곡하는 액션. 장평선, 언어 조건의 조작 기준. 로보 플라밍고. RCSV.
[← 벤치마크]
언어와 시각에서 작곡하는 행동
전체적인 설명
칼빈은 장기간 언어 조건적 조작을 평가한다. 에이전트는 자연어 지침에서 여러 기술을 구성해야 한다. 시뮬레이션 기반. 로보 플라밍고 및 기타 VLM 기반 정책은 강력한 성능을 보여줍니다.
공식 링크
- github.com/mees/calvin
코드 & 데이터 세트
벤치마크는 sim에서 정책을 비교하고, 우리의 평가 루프는 물리적인 기구에서 점수를 제공합니다.







