מדיניות עצבית
מדיניות עצבית היא מדיניות בקרה של רובוט המוגדרת על ידי רשת עצבית המממפת תצפיות (תמונות, proprioception, שפה) ישירות לפעולות (מיקומי מפרקים, דלתות קרטזיאניות, פקודות gripper). בניגוד לצינורות תכנון תנועה קלאסיים, מדיניות עצבית לומדות את המיפוי end-to-end מנתונים ללא ייצוגים ביניים מעוצבים ידנית. מדיניות עצבית מודרנית משתמשת בקודרים קונבולוציוניים לראייה, Transformers למודלינג רצפים, וארכיטקטורות כמו ACT, Diffusion Policy, או גבי VLA לייצור פעולות. תכונה מרכזית של מדיניות עצבית היא שניתן להכשיר אותן מהדגמות או אותות תגמול, מה שמאפשר להן להתמודד עם משימות מורכבות מדי לבקרים מקודדים ידנית. ראה זאת בפועל: ההערכות שלנו בעולם האמיתי →







