💻 computer science

CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks

यह शोध पत्र CRAFT का प्रस्ताव करता है, जो एक ऐसा ढांचा है जो जटिल मल्टी-रोबोट समन्वय कार्यों को उप-कार्यों में स्वायत्त रूप से विभाजित करने के लिए लार्ज लैंग्वेज मॉडल्स (LLMs) का और रिवॉर्ड फंक्शन्स को परिष्कृत करने के लिए विजन लैंग्वेज मॉडल्स (VLMs) का लाभ उठाता है, जिससे मैन्युअल रिवॉर्ड डिजाइन के बिना समन्वय व्यवहारों की प्रभावी सीख और वास्तविक दुनिया में स्थानांतरण सक्षम होता है।

Seoyeon Choi, Kanghyun Ryu, Jonghoon Ock, Negar Mehr2026-06-08
🤖 AI

MatterDoor: Sampling Zero-shot Spatio-semantic Priors using Generative Models

यह शोधपत्र MatterDoor प्रस्तुत करता है, जो एक बेंचमार्क और पाइपलाइन है जो दरवाज़ों के दृश्यों से छिपे हुए इनडोर स्थानों के ज़ीरो-शॉट स्थानिक-सिमेंटिक प्रायोर (spatio-semantic priors) को नमूना लेने के लिए उपलब्ध जेनेरेटिव विज़न मॉडल्स का लाभ उठाता है, जिससे रोबोटों को कार्य-विशिष्ट फाइन-ट्यूनिंग के बिना छिपी हुई संरचनाओं और वस्तुओं के बारे में तर्क करने में सक्षम बनाया जा सके।

Subhransu S. Bhattacharjee, Hao Lu, Dylan Campbell, Rahul Shome2026-06-08
💻 computer science

ActiveGrasp: Information-Guided Active Grasping with Calibrated Energy-based Model

यह शोधपत्र ActiveGrasp का प्रस्ताव करता है, जो एक नवीन फ्रेमवर्क है जो मल्टी-मोडल SE(3) ग्रैस्प वितरण उत्पन्न करने के लिए एक कैलिब्रेटेड एनर्जी-बेस्ड मॉडल को सूचना-निर्देशित सक्रिय दृश्य चयन रणनीति के साथ जोड़ता है ताकि सीमित दृश्य बजट वाले घने क्लटर्ड वातावरण में वस्तुओं को प्रभावी ढंग से पकड़ा जा सके।

Boshu Lei, Wen Jiang, Kostas Daniilidis2026-06-08
💻 computer science

Predicting Dynamic Map States from Limited Field-of-View Sensor Data

यह शोध पत्र यह प्रदर्शित करता है कि डीप लर्निंग मॉडल सीमित फील्ड-ऑफ-व्यू सेंसर डेटा से डायनेमिक मैप अवस्थाओं की प्रभावी ढंग से भविष्यवाणी कर सकते हैं, जो मौजूदा इमेज-टू-इमेज आर्किटेक्चर के अनुकूल एकल-इमेज प्रारूप में टेम्पोरल और स्पेशियल जानकारी को एनकोड करते हैं।

Knut Peterson, David Han2026-06-08
💻 computer science

Robots Need More than VLA and World Models

यह स्थिति पत्र (position paper) यह तर्क देता है कि सामान्यज्ञ रोबोट इंटेलिजेंस (generalist robot intelligence) प्राप्त करने के लिए केवल पॉलिसी स्केलिंग से आगे बढ़कर अनस्ट्रक्चर्ड व्यवहार संबंधी डेटा को चार प्रमुख इंटरफेस—ऑटोलेबलिंग, मोशन रिटारगेटिंग, फिजिक्स-ग्राउंडेड रीजनिंग और रिवॉर्ड इन्फरेंस—के माध्यम से ग्राउंडेड रोबोट सुपरविजन में परिवर्तित करने की महत्वपूर्ण बाधा को संबोधित करना आवश्यक है।

Elis Karcini, Faisal Mehrban, Quang Nguyen, Mac Schwager, Arash Ajoudani, Cesar Cadena, Jan Peters, Marco Hutter, Haitha (…)2026-06-08
💻 computer science

ChronoForest: Closed-Loop Multi-Tree Diffusion Planning for Efficient Bridge Search and Route Composition

ChronoForest एक क्लोज्ड-लूप प्लानिंग सिस्टम है जो टेम्पोरल डिस्टेंस (temporal distance) का मार्गदर्शन के लिए और सर्च-टाइम ब्रिज एविडेंस (search-time bridge evidence) का सत्यापन के लिए उपयोग करके, शॉर्ट-हॉराइजन ऑफलाइन डेटा से लॉन्ग-हॉराइजन रूट्स को कुशलतापूर्वक संयोजित करने के लिए एक ऑनलाइन मल्टी-ट्री ऑर्केस्ट्रेटर के साथ एक एंकर-चेनिंग ट्री डिफ्यूजन प्लानर को जोड़ता है, जिससे जटिल नेविगेशन बेंचमार्क पर अत्याधुनिक प्रदर्शन प्राप्त होता है।

Jungmin Seo, Jaesik Park2026-06-08
💻 computer science

What Matters When Cotraining Robot Manipulation Policies on Everyday Human Videos?

यह शोध पत्र रोज़मर्रा के मानवीय वीडियो पर प्रशिक्षित रोबोट मैनिपुलेशन नीतियों की हस्तांतरणीयता की जांच करता है, जो यह प्रकट करता है कि हालांकि उच्च-गुणवत्ता वाले हैंड पोज़ लेबल फायदेमंद होते हैं, सफल हस्तांतरण के लिए मोशन गैप को पाटने हेतु विशिष्ट विजन और पॉलिसी नेटवर्क की आवश्यकता होती है, जिससे अंततः एक नए को-ट्रेनिंग दृष्टिकोण के माध्यम से कम-रोबोट-डेटा व्यवस्था में 29.7% सफलता दर में सुधार प्राप्त होता है।

Richard Li, Aditya Prakash, Andrew Wen, Saurabh Gupta, Yilun Du, Pulkit Agrawal2026-06-08
🤖 AI

AEGIS: A Backup Reflex for Physical AI

AEGIS फिजिकल AI के लिए एक चयनात्मक एस्केलेशन फ्रेमवर्क है जो एक कमजोर पॉलिसी के प्रक्षेपवक्र (ट्रैजेक्टरी) में उच्च-जोखिम वाले चरणों का पता लगाने के लिए एक हल्के प्रोब का उपयोग करता है और अस्थायी रूप से एक मजबूत पॉलिसी पर स्विच करता है, जो ब्लाइंड या रैंडम एस्केलेशन रणनीतियों की तुलना में लॉन्ग-होरिज़न टास्क रिकवरी दरों में महत्वपूर्ण सुधार करता है।

Josef Chen2026-06-08
⚡ electrical engineering

IDDMBSE: Integrating Data-Driven and Model-Based Systems Engineering for Trusted Autonomous Cyber-Physical Systems

यह शोध पत्र IDDMBSE को प्रस्तुत करता है, जो एक एकीकृत सिस्टम इंजीनियरिंग पद्धति है जो स्वायत्त साइबर-फिजिकल सिस्टम के विश्वसनीय विकास और सत्यापन को सक्षम करने के लिए एक एकीकृत V-प्रक्रिया और ओपन-सोर्स टूल चेन (PERFECT, TRADES-X, और VERITAS) के माध्यम से मॉडल-आधारित सिस्टम इंजीनियरिंग (MBSE) और डेटा-संचालित ML/AI के बीच सेतु का कार्य करता है।

John S. Baras, Sai Sandeep Damera, Ryan Matheu, Clinton Enwerem, Praveen M. S. Kumar2026-06-08
🤖 AI

AxisGuide: Grounding Robot Action Coordinate System in RGB Observations for Robust Visuomotor Manipulation

यह शोध पत्र AxisGuide प्रस्तुत करता है, जो एक हल्का (lightweight) तरीका है जो RGB अवलोकनों के भीतर रोबोट बेस-फ्रेम एक्शन कोऑर्डिनेट्स को स्पष्ट रूप से विज़ुअलाइज़ करके विज़ुओमोटर मैनिपुलेशन पॉलिसियों की मजबूती और सामान्यीकरण को बढ़ाता है ताकि सिमेंटिक समझ और लो-लेवल एक्शन निष्पादन के बीच के अंतर को पाटा जा सके।

Jiyun Jang, Yujin Sung, Woosung Joung, Daewon Chae, Sangwon Lee, Sohwi Kim, Jinkyu Kim, Jungbeom Lee2026-06-08