Masked Autoencoder
Ein selbstüberwachter Pre-Training-Ansatz, bei dem zufällige Bildpflaster maskiert werden und ein ViT-Encoder-Decoder lernt, die fehlenden Pflaster zu rekonstruieren. MAE Pre-Training lernt starke visuelle Repräsentationen, die gut auf nachgelagerte Aufgaben übertragen. In der Robotik bieten MAE-vortrainierte Vision-Encoder robuste Merkmale für Manipulations-Kontrollrichtlinien, besonders bei begrenzten beschrifteten Roboterdaten.







