💻 computer science

Jiao: Bridging Isolation and Customization in Mixed Criticality Robotics

यह शोध पत्र जिआओ (Jiao) प्रस्तुत करता है, जो मिक्स्ड-क्रिटिकैलिटी कंज्यूमर रोबोटिक्स के लिए एक ऐसा आर्किटेक्चर है जो हार्डवेयर-स्तरीय ओवरराइड्स, पैरामीटर सिंक्रोनाइज़ेशन और सुरक्षा-संरेखित संचार को एकीकृत करके प्लेटफॉर्म डेवलपर्स और एंड-यूजर्स के बीच के अंतर को पाटता है ताकि साझा मल्टीकोर प्लेटफॉर्म पर टाइमिंग जिटर और आइसोलेशन में महत्वपूर्ण कमी लाई जा सके।

James Yen, Zhibai Huang, Zhixiang Wei, Tinghao Yi, Shupeng Zeng, Liang Pang, Songtao Xue, Zhengwei Qi2026-05-06
💻 computer science

Say the Mission, Execute the Swarm: Agent-Enhanced LLM Reasoning in the Web-of-Drones

यह शोध पत्र एक एजेंट-संवर्धित (agent-enhanced) LLM फ्रेमवर्क प्रस्तावित करता है जो UAV स्वॉर्म्स के प्राकृतिक भाषा नियंत्रण को सक्षम करने के लिए W3C वेब ऑफ थिंग्स मानकों और मॉडल कॉन्टेक्स्ट प्रोटोकॉल का लाभ उठाता है, यह प्रदर्शित करते हुए कि जबकि वर्तमान LLMs बिना ग्राउंडिंग के विश्वसनीय निष्पादन में संघर्ष करते हैं, कार्य-विशिष्ट उपकरण और रनटाइम गार्डरेल्स मजबूती में महत्वपूर्ण सुधार करते हैं।

Andrea Iannoli, Lorenzo Gigli, Luca Sciullo, Angelo Trotta, Marco Di Felice2026-05-06
💻 computer science

RoboAlign-R1: Distilled Multimodal Reward Alignment for Robot Video World Models

यह शोध पत्र RoboAlign-R1 प्रस्तुत करता है, जो एक ढांचा (framework) है जो एक मल्टीमॉडल टीचर जज को पोस्ट-ट्रेनिंग के लिए रिवॉर्ड मॉडल में डिस्टिल करके और एक स्लाइडिंग विंडो री-एनकोडिंग रणनीति का उपयोग करके रोबोट वीडियो वर्ल्ड मॉडल्स को बढ़ाता है, जिससे इंस्ट्रक्शन फॉलोइंग, मैनिपुलेशन सटीकता, फिजिकल प्लाउज़िबिलिटी और लॉन्ग-होरिज़न प्रेडिक्शन स्टेबिलिटी में महत्वपूर्ण सुधार होता है।

Hao Wu, Yuqi Li, Yuan Gao, Fan Xu, Fan Zhang, Kun Wang, Penghao Zhao, Qiufeng Wang, Yizhou Zhao, Weiyan Wang, Yingli Tia (…)2026-05-06
💻 computer science

Task-Aware Scanning Parameter Configuration for Robotic Inspection Using Vision Language Embeddings and Hyperdimensional Computing

यह शोध पत्र ScanHD प्रस्तुत करता है, जो एक हाइपरडायमेंशनल कंप्यूटिंग फ्रेमवर्क है जो प्राकृतिक भाषा निर्देशों और RGB अवलोकनों के आधार पर स्वायत्त रूप से रोबोटिक लेजर प्रोफाइलर मापदंडों को कॉन्फ़िगर करने के लिए विजन-लैंग्वेज एम्बेडिंग्स का लाभ उठाता है, जो Instruct-Obs2Param नामक एक नए बनाए गए वास्तविक दुनिया के डेटासेट पर उच्च सटीकता और कम-विलंबता प्रदर्शन प्राप्त करता है।

Zhiling Chen, David Gorsich, Matthew P. Castanier, Yang Zhang, Jiong Tang, Farhad Imani2026-05-06
💻 computer science

AutoSpatial: Visual-Language Reasoning for Social Robot Navigation through Efficient Spatial Reasoning Learning

AutoSpatial एक नवीन विधि है जो न्यूनतम मैनुअल पर्यवेक्षण को बड़े पैमाने पर ऑटो-लेबल वाले VQA डेटा और एक पदानुक्रमित दो-चरण प्रशिक्षण रणनीति के साथ जोड़कर सोशल रोबोट नेविगेशन के लिए विजुअल लैंग्वेज मॉडल्स की स्थानिक तर्क क्षमता को बढ़ाती है, जिसके परिणामस्वरूप बेसलाइन मॉडल्स की तुलना में धारणा, तर्क, क्रिया और स्पष्टीकरण में महत्वपूर्ण सुधार होता है।

Yangzhe Kong, Daeun Song, Jing Liang, Dinesh Manocha, Ziyu Yao, Xuesu Xiao2026-05-05
⚡ electrical engineering

Satellite Autonomous Clock Fault Monitoring with Inter-Satellite Ranges Using Euclidean Distance Matrices

यह शोध पत्र चंद्र तारामंडलों (लूनर कॉन्स्टेलेशन) में उपग्रह क्लॉक फेज जंप्स का पता लगाने के लिए एक नवीन, स्थिति-स्वतंत्र ढांचे का प्रस्ताव करता है, जो रिजिड ग्राफ सबस्ट्रक्चर के भीतर उपग्रह-से-उपग्रह रेंज मापों से प्राप्त ज्यामितीय-केंद्रित यूक्लिडियन दूरी मैट्रिसेस के सिंगुलर मानों का विश्लेषण करता है।

Keidai Iiyama, Daniel Neamati, Grace Gao2026-05-05
💻 computer science

Learning to Act Through Contact: A Unified View of Multi-Task Robot Learning

यह शोध पत्र एक एकीकृत ढांचे (unified framework) को प्रस्तुत करता है जो संपर्क लक्ष्यों (contact goals) के अनुक्रमों को स्पष्ट रूप से परिभाषित और निष्पादित करके विभिन्न रोबोटिक रूपात्मकताओं (morphologies) में विविध लोकोमोशन और मैनिपुलेशन कार्यों में महारत हासिल करने के लिए एक एकल लक्ष्य-सशर्त सुदृढीकरण शिक्षण नीति (goal-conditioned reinforcement learning policy) का उपयोग करता है।

Shafeef Omar, Majid Khadiv2026-05-05
🤖 AI

STEP: Warm-Started Visuomotor Policies with Spatiotemporal Consistency Prediction

यह शोध पत्र STEP को प्रस्तुत करता है, जो एक उच्च गुणवत्ता वाले वॉर्म-स्टार्ट एक्शन को उत्पन्न करने के लिए एक हल्के स्थानिक-कालिक निरंतरता भविष्यवक्ता (spatiotemporal consistency predictor) का उपयोग करने और निष्पादन अवरोधों (execution stalls) को रोकने के लिए एक वेग-जागरूक विक्षोभ तंत्र (velocity-aware perturbation mechanism) को नियोजित करके वास्तविक समय के रोबोटिक नियंत्रण को बढ़ाता है, जिससे डिफ्यूजन पॉलिसियों की सफलता दर में उल्लेखनीय सुधार होता है और अनुमान विलंबता (inference latency) में भारी कमी आती है।

Jinhao Li, Yuxuan Cong, Yingqiao Wang, Hao Xia, Shan Huang, Yijia Zhang, Ningyi Xu, Guohao Dai2026-05-05
💻 computer science

ARIS: Agentic and Relationship Intelligence System for Social Robots

यह शोध पत्र ARIS को प्रस्तुत करता है, जो एक मॉड्यूलर एजेंटिक AI फ्रेमवर्क है जो मल्टीमॉडल रीजनिंग, एक ग्राफ-आधारित सोशल वर्ल्ड मॉडल और रिट्रीवल-ऑगमेंटेड जनरेशन को एकीकृत करता है ताकि सोशल रोबोट्स को उपयोगकर्ताओं के साथ संदर्भगत रूप से सुदृढ़, दीर्घकालिक संबंध बनाए रखने में सक्षम बनाया जा सके, जो पेपर रोबोट के साथ एक उपयोगकर्ता अध्ययन में बेसलाइन मॉडल्स की तुलना में काफी अधिक कथित बुद्धिमत्ता और पसंद किए जाने की क्षमता प्रदर्शित करता है।

Stavya Datta, Fucai Ke, Leimin Tian, Hamid Rezatofighi2026-05-05
🤖 machine learning

Learning to Race in Minutes: Infoprop Dyna on the Mini Wheelbot

यह शोध पत्र प्रदर्शित करता है कि इन्फ्रोप्रॉप डायना (Infoprop Dyna) फ्रेमवर्क एक मिनी व्हीलबॉट रोबोट को वास्तविक दुनिया के ट्रैक पर केवल 11 मिनट के भीतर उच्च गति वाली रेसिंग सीखने में सक्षम बनाता है, जिससे सिम-टू-रियल ट्रांसफर के लिए आमतौर पर आवश्यक भौतिकी-आधारित सिमुलेटर और डोमेन रैंडमाइजेशन की आवश्यकता समाप्त हो जाती है।

Devdutt Subhasish, Henrik Hose, Sebastian Trimpe2026-05-05