कारणात्मक भ्रम
अनुकरण सीखने में एक विफलता मोड जहाँ नीति प्रदर्शन डेटा में आभासी सहसंबंधों पर निर्भर करना सीखती है न कि सच्चे कारणात्मक विशेषताओं पर। उदाहरण के लिए, एक ड्राइविंग नीति यह सीख सकती है कि ब्रेक लाइट संकेतक रुकने की भविष्यवाणी करता है, बजाय यातायात स्थितियों के आधार पर रुकना सीखने के। कारणात्मक भ्रम अक्सर ऐसी नीतियों के रूप में प्रकट होता है जो वितरण-भीतर काम करती हैं लेकिन नई परिस्थितियों में अप्रत्याशित रूप से विफल होती हैं।







