💻 computer science

Refining Compositional Diffusion for Reliable Long-Horizon Planning

यह शोध पत्र रिफाइनिंग कंपोजिशनल डिफ्यूजन (RCD) को प्रस्तुत करता है, जो एक ट्रेनिंग-फ्री गाइडेंस विधि है जो सेल्फ-रिकंस्ट्रक्शन एरर और ओवरलैप कंसिस्टेंसी का लाभ उठाकर कंपोजिशनल डिफ्यूजन को हाई-डेंसिटी, ग्लोबली कोहेरेंट ट्रेजेक्टरीज की ओर निर्देशित करती है ताकि लॉन्ग-होरइजन प्लानिंग में मोड-एवरेजिंग को कम किया जा सके।

Kyowoon Lee, Yunhao Luo, Anh Tong, Jaesik Choi2026-05-06
💻 computer science

Robust Path Tracking for Vehicles via Continuous-Time Residual Learning: An ICODE-MPPI Approach

यह शोध पत्र ICODE-MPPI को प्रस्तुत करता है, जो एक सुदृढ़ पाथ-ट्रैकिंग फ्रेमवर्क है जो निरंतर समय (continuous time) में अनमॉडल (unmodeled) अवशिष्ट गतिकी (residual dynamics) को सीखने और क्षतिपूर्ति करने के लिए इनपुट कॉनकोमिटेंट न्यूरल ऑर्डिनरी डिफरेंशियल इक्वेशंस (Input Concomitant Neural Ordinary Differential Equations) को एकीकृत करता है, जिससे मानक मॉडल प्रेडिक्टिव पाथ इंटीग्रल (Model Predictive Path Integral) विधियों की तुलना में क्रॉस-ट्रैकिंग त्रुटियों में महत्वपूर्ण कमी और अधिक सुचारू नियंत्रण प्राप्त होता है।

Shugen Song, Wenjie Mei, Chengyan Zhao2026-05-06
🤖 machine learning

RLDX-1 Technical Report

यह शोधपत्र RLDX-1 प्रस्तुत करता है, जो मल्टी-स्ट्रीम एक्शन ट्रांसफॉर्मर (MSAT) आर्किटेक्चर पर आधारित एक सामान्य रोबोटिक पॉलिसी है, जो विषम मोडैलिटीज़ और विशिष्ट सिस्टम डिज़ाइन्स को एकीकृत करता है ताकि जटिल, संपर्क-समृद्ध और गतिशील वास्तविक दुनिया के डेक्सट्रस मैनिपुलेशन कार्यों में मौजूदा विज़न-लैंग्वेज-एक्शन मॉडल्स से काफी बेहतर प्रदर्शन किया जा सके।

Dongyoung Kim, Huiwon Jang, Myungkyu Koo, Suhyeok Jang, Taeyoung Kim, Beomjun Kim, Byungjun Yoon, Changsung Jang, Daewon (…)2026-05-06
💻 computer science

TACO: Trajectory Aligning Cross-view Optimisation

TACO एक मजबूती से जुड़े हुए IMU और सूक्ष्म-स्तरीय क्रॉस-व्यू जियोलोकेशन पाइपलाइन का एक टट-कपल्ड (tightly-coupled) सिस्टम है जो इनर्शियल ड्रिफ्ट को ठीक करने के लिए सैटेलाइट-इमेज मैचिंग को गतिशील रूप से ट्रिगर करके सक्षम बनाता है, जिससे GNSS-स्वतंत्र पूर्ण स्थिति निर्धारण संभव होता है, और KITTI डेटासेट पर प्रक्षेपवक्र त्रुटि (trajectory error) में लगभग छह गुना कमी लाता है।

Tavis Shore, Oscar Mendez, Simon Hadfield2026-05-06
⚡ electrical engineering

Learning Reactive Dexterous Grasping via Hierarchical Task-Space RL Planning and Joint-Space QP Control

यह शोध पत्र एक हाइब्रिड पदानुक्रमित नियंत्रण ढांचे (hybrid hierarchical control framework) का प्रस्ताव करता है जो उच्च-स्तरीय टास्क-स्पेस प्लानिंग के लिए मल्टी-एजेंट सुदृढीकरण लर्निंग (multi-agent reinforcement learning) को लो-लेवल जॉइंट-स्पेस निष्पादन के लिए GPU-समानांतरित क्वाड्रेटिक प्रोग्रामिंग (GPU-parallelized quadratic programming) के साथ जोड़ता है, जिससे एक 7-DoF आर्म और 20-DoF हैंड पर असंरचित वातावरण में मजबूत, ज़ीरो-शॉट हस्तांतरणीय और सुरक्षित प्रतिक्रियाशील दक्ष पकड़ (dexterous grasping) सक्षम होती है।

Ho Jae Lee, Yonghyeon Lee, Alexander Alexiev, Tzu-Yuan Lin, Se Hwan Jeon, Sangbae Kim2026-05-06
💻 computer science

Bridging the Embodiment Gap: Disentangled Cross-Embodiment Video Editing

यह शोध पत्र एक ऐसे जनरेटिव फ्रेमवर्क का प्रस्ताव करता है जो एकल मानव प्रदर्शनों से सुसंगत रोबोट निष्पादन वीडियो को संश्लेषित करने के लिए एक दोहरे कंट्रास्टिव उद्देश्य के माध्यम से कार्य और एम्बॉडिमेंट (embodiment) निरूपणों को अलग करता है, जो युग्मित क्रॉस-एम्बॉडिमेंट डेटा की आवश्यकता के बिना प्रभावी रूप से वितरण अंतराल को पाटता है।

Zhiyuan Li, Wenyan Yang, Wenshuai Zhao, Yue Ma, Yuanpeng Tu, Pekka Marttinen, Joni Pajarinen2026-05-06
💻 computer science

Jiao: Bridging Isolation and Customization in Mixed Criticality Robotics

यह शोध पत्र जिआओ (Jiao) प्रस्तुत करता है, जो मिक्स्ड-क्रिटिकैलिटी कंज्यूमर रोबोटिक्स के लिए एक ऐसा आर्किटेक्चर है जो हार्डवेयर-स्तरीय ओवरराइड्स, पैरामीटर सिंक्रोनाइज़ेशन और सुरक्षा-संरेखित संचार को एकीकृत करके प्लेटफॉर्म डेवलपर्स और एंड-यूजर्स के बीच के अंतर को पाटता है ताकि साझा मल्टीकोर प्लेटफॉर्म पर टाइमिंग जिटर और आइसोलेशन में महत्वपूर्ण कमी लाई जा सके।

James Yen, Zhibai Huang, Zhixiang Wei, Tinghao Yi, Shupeng Zeng, Liang Pang, Songtao Xue, Zhengwei Qi2026-05-06
💻 computer science

Say the Mission, Execute the Swarm: Agent-Enhanced LLM Reasoning in the Web-of-Drones

यह शोध पत्र एक एजेंट-संवर्धित (agent-enhanced) LLM फ्रेमवर्क प्रस्तावित करता है जो UAV स्वॉर्म्स के प्राकृतिक भाषा नियंत्रण को सक्षम करने के लिए W3C वेब ऑफ थिंग्स मानकों और मॉडल कॉन्टेक्स्ट प्रोटोकॉल का लाभ उठाता है, यह प्रदर्शित करते हुए कि जबकि वर्तमान LLMs बिना ग्राउंडिंग के विश्वसनीय निष्पादन में संघर्ष करते हैं, कार्य-विशिष्ट उपकरण और रनटाइम गार्डरेल्स मजबूती में महत्वपूर्ण सुधार करते हैं।

Andrea Iannoli, Lorenzo Gigli, Luca Sciullo, Angelo Trotta, Marco Di Felice2026-05-06
💻 computer science

RoboAlign-R1: Distilled Multimodal Reward Alignment for Robot Video World Models

यह शोध पत्र RoboAlign-R1 प्रस्तुत करता है, जो एक ढांचा (framework) है जो एक मल्टीमॉडल टीचर जज को पोस्ट-ट्रेनिंग के लिए रिवॉर्ड मॉडल में डिस्टिल करके और एक स्लाइडिंग विंडो री-एनकोडिंग रणनीति का उपयोग करके रोबोट वीडियो वर्ल्ड मॉडल्स को बढ़ाता है, जिससे इंस्ट्रक्शन फॉलोइंग, मैनिपुलेशन सटीकता, फिजिकल प्लाउज़िबिलिटी और लॉन्ग-होरिज़न प्रेडिक्शन स्टेबिलिटी में महत्वपूर्ण सुधार होता है।

Hao Wu, Yuqi Li, Yuan Gao, Fan Xu, Fan Zhang, Kun Wang, Penghao Zhao, Qiufeng Wang, Yizhou Zhao, Weiyan Wang, Yingli Tia (…)2026-05-06
💻 computer science

Task-Aware Scanning Parameter Configuration for Robotic Inspection Using Vision Language Embeddings and Hyperdimensional Computing

यह शोध पत्र ScanHD प्रस्तुत करता है, जो एक हाइपरडायमेंशनल कंप्यूटिंग फ्रेमवर्क है जो प्राकृतिक भाषा निर्देशों और RGB अवलोकनों के आधार पर स्वायत्त रूप से रोबोटिक लेजर प्रोफाइलर मापदंडों को कॉन्फ़िगर करने के लिए विजन-लैंग्वेज एम्बेडिंग्स का लाभ उठाता है, जो Instruct-Obs2Param नामक एक नए बनाए गए वास्तविक दुनिया के डेटासेट पर उच्च सटीकता और कम-विलंबता प्रदर्शन प्राप्त करता है।

Zhiling Chen, David Gorsich, Matthew P. Castanier, Yang Zhang, Jiong Tang, Farhad Imani2026-05-06