SeededGrasp: Language-Guided Grasping in Complex Scenes with Multiple Embodiments
SeededGrasp एक डेटा-कुशल फ्रेमवर्क है जो एक विजन-लैंग्वेज मॉडल का उपयोग करके एक लाइटवेट ग्रैस्प जनरेटर के लिए सीड पॉइंट (seed point) की भविष्यवाणी करता है, जिससे उच्च-स्तरीय सिमेंटिक रीजनिंग को निम्न-स्तरीय ज्यामितीय निष्पादन से अलग किया जाता है, जो बिना महंगे एंड-टू-एंड प्रशिक्षण के जटिल दृश्यों में मजबूत, मल्टी-एम्बॉडिमेंट ग्रैस्पिंग को सक्षम बनाता है।