التقسيم الدلالي
تصنيف كل بكسل في الصورة إلى مجموعة محددة مسبقاً من الفئات (الأرضية، الطاولة، الجسم، الروبوت). يوفر التقسيم الدلالي فهماً كثيفاً للمشهد لتنقل الروبوت (كشف السطح القابل للقيادة) والمعالجة (فصل الأجسام عن الخلفية). تشمل البنى المعمارية U-Net و DeepLab و SegFormer.







