חזרה לGlossary

שיבוט התנהגות (BC)

Imitation LearningSupervised Learning

שיבוט התנהגות הוא הצורה הפשוטה ביותר של לימוד חיקוי: בעיית רגרסיה מפוקחת שבה המדיניות מאומנת לחקות הדגמות מומחה על ידי מזעור שגיאת החיזוי בין פלט המדיניות לפעולת המומחה בכל מצב שנצפה. BC קל ליישום וקנה מידה טוב עם נתונים, אך סובל מהסטת התפלגות — מכיוון שהוא לעולם לא מקבל משוב תיקוני, שגיאות קטנות גורמות לרובוט לבקר במצבים שלא היו בנתוני ההדרכה, מה שיכול להתגבר לכשל משימה. טכניקות כמו DAgger (Dataset Aggregation) ו-GAIL פותחו במיוחד כדי להתמודד עם בעיית השגיאה המצטברת של BC. ראה זאת בפועל: שירות איסוף הנתונים שלנו →

Related terms