Glossary(으)로 돌아가기

언어 조건부 제어정책

VLAFoundation ModelGeneralization

언어 조건부 제어정책은 자연어 지시사항(예: "빨간 컵을 집어서 트레이 위에 놓다")을 시각 관찰과 함께 추가 입력으로 받으며, 단일 제어정책 네트워크가 재학습 없이 런타임에 선택된 여러 작업을 수행할 수 있게 합니다. 언어 조건부 설정은 일반적으로 사전학습된 언어 모델(CLIP, T5, PaLM)로 지시사항을 인코딩하고 결과 임베딩을 이미지 특성과 융합하여 구현됩니다. RT-2, OpenVLA, pi0 같은 VLA 모델은 설계상 언어 조건부입니다. 이 접근 방식은 작업당 별도의 제어정책을 학습할 필요를 줄이고 새로운 지시사항 표현에 대한 영점 일반화를 지원합니다. 실제 사례 보기: 우리의 실제 평가 →

Related terms