חזרה לGlossary

DINOv2

MLVisionRepresentation Learning

מודל vision transformer בהשגחה עצמית שאומן על ידי Meta על מערך נתונים מעוקר של 142M תמונות באמצעות מטרת self-distillation. DINOv2 לומד ייצוגים ויזואליים חזקים ללא תוויות כלשהן. התכונות שלו מעברות היטב למשימות רובוטיקה — מדיניות מניפולציה המשתמשות בקודרים DINOv2 קפואים משיגות ביצועים חזקים עם fine-tuning מינימלי על נתוני רובוט.

Related terms