मुखौटा ऑटोएनकोडर
एक स्व-पर्यवेक्षित पूर्व-प्रशिक्षण दृष्टिकोण जहां एक छवि के यादृच्छिक पैच को मुखौटा किया जाता है, और एक ViT एनकोडर-डिकोडर लापता पैच को पुनर्निर्माण करना सीखता है। MAE पूर्व-प्रशिक्षण मजबूत दृश्य प्रतिनिधित्व सीखता है जो डाउनस्ट्रीम कार्यों में अच्छी तरह से स्थानांतरित होते हैं। रोबोटिक्स में, MAE-पूर्व-प्रशिक्षित दृष्टि एनकोडर हेराफेरी नीतियों के लिए मजबूत विशेषताएं प्रदान करते हैं, विशेष रूप से सीमित लेबल किए गए रोबोट डेटा के साथ।







