سياسة مشروطة باللغة
تأخذ السياسة المشروطة باللغة تعليمات اللغة الطبيعية (مثل "التقط الكوب الأحمر وضعه على الصينية") كمدخل إضافي إلى جانب الملاحظات البصرية، مما يتيح لشبكة سياسة واحدة تنفيذ مهام متعددة يتم اختيارها في وقت التشغيل دون إعادة تدريب. يتم تنفيذ التكييف اللغوي عادةً بترميز التعليمات باستخدام نموذج لغة مدرب مسبقاً (CLIP أو T5 أو PaLM) ودمج التضمين الناتج مع ميزات الصورة. نماذج VLA مثل RT-2 و OpenVLA و pi0 مشروطة باللغة بالتصميم. يقلل هذا النهج من الحاجة إلى تدريب سياسات منفصلة لكل مهمة ويدعم التعميم بدون أمثلة على صيغ التعليمات الجديدة. انظر هذا عملياً: تقييماتنا في العالم الحقيقي →







