ओपन-वोकैबुलरी हेरफेर
एक रोबोट की क्षमता मुक्त-रूप भाषा विवरणों द्वारा निर्दिष्ट वस्तुओं में हेरफेर करने की, यहां तक कि प्रशिक्षण के दौरान न देखी गई वस्तुओं को भी। ओपन-वोकैबुलरी हेरफेर VLMs (भाषा प्रश्नों से वस्तुओं की पहचान के लिए) को हेरफेर नीतियों के साथ जोड़ता है। CLIPort, VIMA, और RT-2 जैसे मॉडल दृश्य अवलोकनों में भाषा को आधार बनाकर ओपन-वोकैबुलरी क्षमताओं का प्रदर्शन करते हैं।







