← नवीनतम पेपर
💻 computer science

MetaPusher: Meta Learning and Planning for Nonprehensile Manipulation of Unseen Objects with Rapid Online Adaption

MetaPusher एक मेटा-लर्निंग और एडेप्टिव प्लानिंग फ्रेमवर्क है जो एक मेटा-लर्न्ड डायनेमिक्स मॉडल को एक ट्री-रियूजिंग काइनोडायनेमिक प्लानर के साथ जोड़कर अनदेखे ऑब्जेक्ट्स के नॉनप्रेहेन्साइल मैनिपुलेशन के लिए तीव्र ऑनलाइन अनुकूलन और कुशल लॉन्ग-होरिज़न प्लानिंग को सक्षम बनाता है, जिससे बिना किसी पूर्व ऑब्जेक्ट-विशिष्ट इंटरैक्शन के उत्कृष्ट कार्य सफलता दर प्राप्त होती है।

मूल लेखक: Donghyung Lee, Seyedali Golestaneh, Jaskrit Singh, Zhuoyun Zhong, Athanasios Kapoutsis, Constantinos Chamzas

प्रकाशित 2026-09-21
📖 5 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Donghyung Lee, Seyedali Golestaneh, Jaskrit Singh, Zhuoyun Zhong, Athanasios Kapoutsis, Constantinos Chamzas

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

रोबोट लंबे समय से फैक्ट्री फ्लोर के उस्ताद रहे हैं, जहाँ उन्हें एक विशिष्ट पेंच उठाने या एक विशिष्ट जोड़ को पूरी सटीकता के साथ वेल्ड करने के लिए सिखाया जा सकता है। लेकिन जिस क्षण एक रोबोट ऐसी वस्तु का सामना करता है जिसे उसने पहले कभी नहीं देखा है, अक्सर एक मूक संकट उत्पन्न हो जाता है। मशीन को यह नहीं पता होता कि वस्तु कितनी भारी है, उसका गुरुत्वाकर्षण केंद्र कहाँ है, या मेज के विरुद्ध उसकी सतह का घर्षण कितना है। इस छिपे हुए भौतिक ज्ञान के बिना, एक बॉक्स को धकेलने वाला रोबोट उसे बहुत ज़ोर से धकेल सकता है जिससे वह उड़ जाए, या बहुत धीरे धकेल सकता है जिससे वह वहीं फंसा रह जाए। यह 'नॉनप्रिहेन्साइल मैनिपुलेशन' (nonprehensile manipulation) की चुनौती है: वस्तुओं को पकड़े बिना उन्हें हिलाना, इसके बजाय धकेलने, खिसकाने और धकेलने पर निर्भर रहना। एक रोबट के लिए वास्तविक, अव्यवस्थित और अप्रत्याशित दुनिया में सफल होने के लिए, उसे न केवल किसी वस्तु को देखना चाहिए, बल्कि यह भी तेजी से सीखना चाहिए कि छूने पर वह वस्तु कैसे व्यवहार करती है, और यह सब करते हुए उसे नई जगह पर ले जाने के लिए सबसे अच्छे मार्ग का पता लगाना चाहिए।

शोधकर्ताओं की एक टीम ने इस सटीक समस्या को हल करने के लिए METAPUSHER नामक एक नई प्रणाली विकसित की है। हर नई वस्तु को एक पूर्ण रहस्य मानने के बजाय, जिसके लिए घंटों के परीक्षण और त्रुटि की आवश्यकता होती है, उनका रोबोट "मेटा-लर्निंग" के एक रूप का उपयोग करता है। कल्पना कीजिए कि एक छात्र जिसने हजारों अलग-अलग किताबें पढ़ी हैं; जब वह एक नई किताब खोलता है, तो वह शून्य से शुरुआत नहीं करता है। वह पहले से ही समझता है कि भाषा कैसे काम करती है, अध्याय कैसे संरचित होते हैं, और मुख्य विचार कैसे खोजा जाता है। इसी तरह, METAPUSHER को पहले सिम्युलेटेड वस्तुओं के एक विशाल पुस्तकालय पर प्रशिक्षित किया जाता है, जिससे वह चीजों के धकेलने पर फिसलने और घूमने के सामान्य नियमों को सीखता है। यह प्रशिक्षण रोबोट को एक शुरुआती बढ़त देता है, एक प्रकार की भौतिक अंतर्दृष्टि जो उसे यह अनुमान लगाने की अनुमति देती है कि एक नई, अनदेखी वस्तु स्पर्श करने से पहले ही कैसे प्रतिक्रिया देगी।

एक बार जब रोबोट अपना कार्य शुरू करता है, तो वह केवल उस प्रारंभिक अनुमान पर निर्भर नहीं रहता है। जैसे ही वह वस्तु को धकेलता है, वह बारीकी से देखता है कि क्या वस्तु ठीक वैसे ही चलती है जैसा अनुमान लगाया गया था। यदि वस्तु उम्मीद से अधिक फिसलती है या अलग दिशा में घूमती है, तो रोबोट तुरंत उस विशिष्ट वस्तु के भौतिकी के अपने आंतरिक मॉडल को अपडेट कर देता है। यह कार्य के दौरान, वास्तविक समय में होता है। रोबोट केवल सीख ही नहीं रहा है; वह योजना भी बना रहा है। वह लक्ष्य तक एक लंबे मार्ग को मैप करने के लिए एक परिष्कृत खोज रणनीति का उपयोग करता है, लेकिन पुराने सिस्टम के विपरीत जो नई जानकारी आने पर पूरे प्लान को छोड़कर फिर से शुरू कर देते थे, METAPUSHER इतना चतुर है कि वह उन हिस्सों को बनाए रखता है जो अभी भी काम कर रहे हैं। यह योजना की उन शाखाओं को हटा देता है जो अब वैध नहीं हैं और शेष भाग को परिष्कृत करता है, जिससे रोबोट रास्ता भटके बिना चलते-चलते अपने मार्ग को अनुकूलित कर पाता है।

शोधकर्ताओं ने इस प्रणाली का परीक्षण विभिन्न अनदेखी वस्तुओं पर किया, जिनमें एक टीपॉट से लेकर एक पावर ड्रिल तक शामिल थे, पहले एक कंप्यूटर सिमुलेशन में और फिर एक वास्तविक प्रयोगशाला में एक भौतिक रोबोटिक आर्म पर। सिमुलेशन में, प्रणाली ने अन्य तरीकों की तुलना में बहुत कम इंटरैक्शन के साथ यह सीखने में सफलता प्राप्त की कि वस्तुएं कैसे हिलेंगी, जिससे इसके पूर्वानुमान की त्रुटियां तेजी से कम हुईं। जब इस प्रणाली को वास्तविक दुनिया में ले जाया गया, जहाँ सेंसर अपूर्ण हैं और भौतिकी अव्यवस्थित हो सकती है, तो यह डगमगाया नहीं। चार अलग-अलग अनदेखी वस्तुओं से जुड़े परीक्षणों की एक श्रृंखला में, रोबोट ने शत-प्रतिशत सफलता दर हासिल की, प्रत्येक वस्तु को उसके लक्ष्य स्थान तक पहुँचाया। इसने अपने पूर्व-सीखे गए ज्ञान को तीव्र, मौके पर किए गए समायोजनों के साथ जोड़कर यह सिद्ध किया कि एक रोबोट एक साथ त्वरित सीखने वाला और सावधानीपूर्वक योजना बनाने वाला दोनों हो सकता है।

इस अध्ययन ने अन्य सामान्य रणनीतियों के विरुद्ध भी इस दृष्टिकोण की तुलना की। कुछ विधियाँ प्रत्येक नई वस्तु के लिए बड़ी मात्रा में डेटा एकत्र करने पर निर्भर थीं, जबकि अन्य कार्य के दौरान सब कुछ शून्य से सीखने का प्रयास करती थीं। METAPUSHER ने इन दृष्टिकोणों को पीछे छोड़ दिया, लक्ष्य तक पहुँचने के लिए कम धक्कों की आवश्यकता पड़ी और कम गलतियाँ हुईं। और भी अधिक प्रभावशाली रूप से, यह प्रणाली उस रोबोट के लगभग समान प्रदर्शन करती है जिसे उस सटीक वस्तु पर विशेष रूप से प्रशिक्षित किया गया था जिसे वह हिला रहा था, जबकि उसने उस वस्तु को पहले कभी नहीं देखा था। यह सुझाव देता है कि रोबोट के पिछले अनुभवों से सामान्यीकरण करने की क्षमता अज्ञात को संभालने के लिए पर्याप्त मजबूत है।

हालाँकि वर्तमान प्रणाली मेज पर सपाट, द्वि-आयामी धकेलने के लिए अच्छी तरह से काम करती है, शोधकर्ता स्वीकार करते हैं कि वास्तविक दुनिया त्रि-आयामी है और अधिक जटिल अंतःक्रियाओं से भरी है। भविष्य के कार्य इन क्षमताओं को पूर्ण 3D मूवमेंट और अधिक जटिल संपर्क बिंदुओं तक विस्तारित करने पर केंद्रित होंगे। फिलहाल, METAPUSHER एक महत्वपूर्ण कदम है। यह प्रदर्शित करता है कि रोबोटों को एक लचीली, अनुकूलन योग्य बुद्धि से लैस किया जा सकता है जो उन्हें हर संभव वस्तु को याद करने के बजाय, गति के अंतर्निहित सिद्धांतों को समझकर और गति और सटीकता के साथ अज्ञात के अनुकूल बनकर भौतिक दुनिया में नेविगेट करने की अनुमति देती है।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →