डेटा फ्लाईव्हील
एक सद्गुण चक्र जहां एक तैनात रोबोट नीति नई इंटरैक्शन डेटा उत्पन्न करती है, जिसका उपयोग नीति में सुधार के लिए किया जाता है, जो बेहतर डेटा उत्पन्न करती है, और इसी तरह। यह अवधारणा वास्तविक दुनिया की रोबोट सीखने की प्रणालियों के लिए केंद्रीय है — प्रत्येक तैनाती चक्र प्रशिक्षण डेटासेट में जोड़ता है। स्व-सुधार लूप, सक्रिय सीखना, और बेड़े सीखना डेटा फ्लाईव्हील को चलाने वाली तंत्र हैं।







