💻 computer science

A Unified Framework for Automated Assembly Sequence and Production Line Planning using Graph-based Optimization

यह शोध पत्र PyCAALP को प्रस्तुत करता है, जो एक ओपन-सोर्स फ्रेमवर्क है जो जटिल विनिर्माण अनुकूलन समस्याओं को कुशलतापूर्वक हल करने के लिए किनेमैटिक व्यवहार्यता जांच (kinematic feasibility checks) और एक नियतात्मक पथ-निर्देशित मिश्रित-पूर्णांक प्रोग्राम (deterministic path-guided Mixed-Integer Program) न्यूनीकरण के साथ एक ग्राफ-आधारित दृष्टिकोण का उपयोग करके स्वचालित असेंबली अनुक्रम योजना (Assembly Sequence Planning) और उत्पादन लाइन योजना (Production Line Planning) को एकीकृत करता है।

Christoph Hartmann (Technical University of Munich, Chair of Metal Forming and Casting), Marios Demetriades (Technical U (…)2026-07-27
💻 computer science

GuidedAttention: Interpretable and Correctable Visual Attention for OOD-Robust Robot Manipulation via Imitation Learning

GuidedAttention एक व्याख्यात्मक इमिटेशन लर्निंग फ्रेमवर्क है जो रोबोटिक मैनिपुलेशन में आउट-ऑफ-डिस्ट्रीब्यूशन मजबूती को बढ़ाता है, जिससे उपयोगकर्ताओं को रोलआउट इनिशियलाइजेशन के दौरान कार्य-प्रासंगिक विजुअल अटेंशन कीपॉइंट्स का निरीक्षण और सुधार करने की अनुमति मिलती है, जिन्हें फिर एक डिफ्यूजन-आधारित एक्शन पॉलिसी को निर्देशित करने के लिए निष्पादन के दौरान स्वचालित रूप से प्रसारित किया जाता है।

Masaki Murooka, Ryoichi Nakajo, Keisuke Shirai, Tomohiro Motoda, Hanbit Oh, Ryo Hanai, Yukiyasu Domae2026-07-27
💻 computer science

Ordered Action Tokens for Visuomotor Policy Learning

यह शोध पत्र ऑर्डर्ड एक्शन टोकनाइजेशन (OAT) प्रस्तुत करता है, जो एक सीखा हुआ तरीका है जो निरंतर रोबोटिक एक्शन चंक्स को संरचित, क्रमबद्ध अनुक्रमों में विविक्त (discretize) करता है ताकि उच्च संपीड़न और पूर्ण डिकोडेबिलिटी प्राप्त की जा सके, जिससे लागत और निष्ठा के बीच लचीले इन्फरेंस-टाइम ट्रेडऑफ़ सक्षम होते हैं और विविध सिमुलेशन एवं वास्तविक दुनिया के कार्यों में विसुओमोटर पॉलिसी प्रदर्शन में निरंतर सुधार होता है।

Chaoqi Liu, Yue Zhao, Haonan Chen, Xiaoshen Han, Jiawei Gao, Ehsan Adeli, Yilun Du2026-07-27
💻 computer science

Addressing the Orchestration Gap in Generalist Robots via Physical Agency

यह शोध पत्र "पिगी" (Pigey) को प्रस्तुत करता है, जो एक उच्च-स्तरीय ऑर्केस्ट्रेटर है जो जटिल कार्यों को उप-लक्ष्यों में विभाजित करके और एक क्लोज्ड-लूप भौतिक एजेंसी के माध्यम से मौजूदा फ्रोजन विजन-लैंग्वेज-एक्शन पॉलिसियों को प्रबंधित करके "ऑर्केस्ट्रेशन गैप" को पाटता है, जिससे बिना किसी अतिरिक्त डेटा या फाइन-ट्यूनिंग के तर्क-प्रधान रोबोटिक कार्यों पर महत्वपूर्ण प्रदर्शन सुधार प्राप्त होता है।

Liane Galanti, Dhruv Shah, Tri Dao2026-07-27
💻 computer science

StARS: Socially Appropriate Robot Actions via a Recommender System-Driven Approach

यह शोधपत्र StARS को प्रस्तुत करता है, जो एक मॉडल-अज्ञेय (model-agnostic) ढांचा है जो व्यक्तिगत उपयोगकर्ता मानदंडों और विशिष्ट संदर्भों के अनुरूप अनुकूलित, व्यक्तिगत और सामाजिक रूप से उपयुक्त रोबोटिक क्रियाएं उत्पन्न करके मानव-रोबोट संपर्क में अंतर-विषय परिवर्तनशीलता (inter-subject variability) को संबोधित करने के लिए अनुशंसा प्रणाली (recommender system) तकनीकों का लाभ उठाता है।

Erencem Ozbey, Fethiye Irmak Dogan, Jin Huang, Hatice Gunes2026-07-27
🤖 AI

ACME: A Multi-Cultural, Multi-Embodiment Social-Navigation Dataset

यह शोध पत्र ACME को प्रस्तुत करता है, जो एक बड़े पैमाने का, बहु-सांस्कृतिक और बहु-एम्बोडिमेंट डेटासेट है जिसे पांच देशों में सामाजिक रोबोट नेविगेशन अनुसंधान को आगे बढ़ाने के लिए एकत्र किया गया है, ताकि विविध, लक्ष्य-संचालित इंटरेक्शन डेटा प्रदान करके मौजूदा संसाधनों में सांस्कृतिक और भौगोलिक विविधता की कमी को दूर किया जा सके।

Shashank Rao Marpally, Allan Wang, Atharva Ghotavadekar, Renato Alexandre Ribeiro, Nhat Le, Pilar Bachiller-Burgos, Pran (…)2026-07-27
🤖 AI

Zero-Shot Mission-Level Evaluation for Aerial MLLM Agents

यह शोध पत्र मिशनबेंच (MissionBench) को प्रस्तुत करता है, जो हवाई 3D वातावरणों में मल्टीमॉडल लार्ज लैंग्वेज मॉडल्स की ज़ीरो-शॉट मिशन-स्तरीय क्षमताओं के मूल्यांकन के लिए एक बेंचमार्क है, जो यह प्रकट करता है कि हालांकि स्केलिंग प्रदर्शन में सुधार करती है, फिर भी वर्तमान मॉडल मल्टी-स्टेप प्लानिंग और एडेप्टिव रीजनिंग की आवश्यकता वाले जटिल, लॉन्ग-होरिज़ॉन एम्बोडीड कार्यों में मनुष्यों से काफी पीछे हैं।

Suman Navaratnarajah, Taehyoung Kim, Jona Ruthardt, Ishaan Bhimwal, Ryousuke Yamada, Yannik Blei, Wolfram Burgard, Yuki (…)2026-07-27
💻 computer science

Flight-Ready LiDAR-Inertial Odometry for Embedded Drone Platforms

यह शोध पत्र मौजूदा ओपन-सोर्स LiDAR-इनर्शियल ओडोमेट्री प्रणालियों में महत्वपूर्ण वास्तुशिल्प कमियों को संबोधित करता है जो विशिष्ट संशोधनों को पेश करके स्थिर 200 हर्ट्ज ओडोमेट्री आउटपुट और पूर्ण वेग अवस्थाओं को प्राप्त करने के माध्यम से वास्तविक समय ड्रोन नियंत्रण में बाधा डालती हैं, जिससे अंतर्निहित एस्टीमेटर को बदले बिना एम्बेडेड UAV प्लेटफार्मों पर उड़ान प्रदर्शन में महत्वपूर्ण सुधार होता है।

Alvaro J. Gaona, David Perez-Saura, Francisco J. Anguita, Pascual Campoy2026-07-27
💻 computer science

JustDepth: Real-Time Radar-Camera Depth Estimation with Single-Scan LiDAR Supervision

JustDepth एक सिंगल-स्टेज, रियल-टाइम रडार-कैमरा डेप्थ एस्टीमेशन फ्रेमवर्क है जो रडार रिटर्न्स को एक फिक्स्ड-विड्थ 1D रिप्रेजेंटेशन में एकत्रित करके और ग्लोबल डेप्थ प्रोपेगेशन के लिए एक लाइटवेट GNN का उपयोग करके उच्च सटीकता और काफी कम इन्फरेंस लेटेंसी प्राप्त करता है, जबकि इसे पूरी तरह से सिंगल-स्कैन LiDAR सुपरविजन के साथ प्रशिक्षित किया गया है।

Wooyung Yun, Dongwook Kim, Soomok Lee2026-07-27
💻 computer science

Safe Learning Predictive Control for Ego-World Robotic Systems

यह शोधपत्र SOWL-MPC प्रस्तुत करता है, जो एक सुरक्षित लर्निंग-आधारित प्रेडिक्टिव कंट्रोल फ्रेमवर्क है जो ऑनलाइन स्पार्स वेरिएशनल गॉसियन प्रोसेस लर्निंग को अनिश्चितता-जागरूक मॉडल प्रेडिक्टिव कंट्रोल के साथ जोड़कर एक ईगो रोबोट को अज्ञात वर्ल्ड रोबॉट्स वाले साझा वातावरण में नेविगेट करने में सक्षम बनाता है।

Davide Valenti, Giuseppe Notarstefano2026-07-27