Manual2Skill++: Connector-Aware General Robotic Assembly from Instruction Manuals via Vision-Language Models
يُعد Manual2Skill++ إطار عمل للرؤية واللغة يعزز التجميع الروبوتي من خلال معاملة الوصلات ككيانات أساسية، حيث يستخرج تلقائياً بيانات الوصلات المهيكلة من أدلة التعليمات لبناء رسوم بيانية مهامية هرمية للتنفيذ الموثوق عبر سيناريوهات متنوعة.