السياسة العصبية
السياسة العصبية هي سياسة تحكم روبوتية معاملة بشبكة عصبية تعيين الملاحظات (الصور، الملكية الذاتية، اللغة) مباشرة إلى الإجراءات (مواضع المفاصل، دلتا ديكارت، أوامر الماسك). على عكس خطوط أنابيب التخطيط الحركي الكلاسيكية، تتعلم السياسات العصبية التعيين من النهاية إلى النهاية من البيانات دون تمثيلات وسيطة مصممة يدوياً. تستخدم السياسات العصبية الحديثة محركات ترميز التفافية للرؤية، و Transformers لنمذجة التسلسل، ومعماريات مثل ACT و Diffusion Policy أو ظهور VLA لتوليد الإجراءات. الخاصية الرئيسية للسياسات العصبية هي أنه يمكن تدريبها من العروض التوضيحية أو إشارات المكافأة، مما يمكنها من التعامل مع المهام المعقدة جداً للمتحكمات المشفرة يدوياً. انظر هذا عملياً: تقييماتنا في العالم الحقيقي →







