💻 computer science

Guided Riemannian Optimization (GuRO): Bridging Model Predictive Control and Decision Transformers

यह शोध पत्र गाइडेड रिमैनियन ऑप्टिमाइज़ेशन (GuRO) को प्रस्तुत करता है, जो एक नवीन ढांचा है जो मॉडल प्रेडिक्टिव कंट्रोल को डिसीजन ट्रांसफॉर्मर्स के साथ एकीकृत करता है और उच्च-आयामी, गैर-रेखीय रोबोटिक नियंत्रण कार्यों में तेज़, अधिक सुदृढ़ प्रशिक्षण और बेहतर प्रदर्शन प्राप्त करने के लिए वक्रता-जागरूक (curvature-aware) रिमैनियन ऑप्टिमाइज़ेशन का उपयोग करता है।

Hossein Abdi, Satya Prakash Dash, Mingfei Sun2026-08-25
💻 computer science

OptiSight: Bridging Semantic Reasoning and Geometric Control for Embodied Navigation

ऑप्टिसाइट (OptiSight) एक हाइब्रिड फ्रेमवर्क है जो लक्ष्य स्थानीयकरण के लिए ग्राउंडेड-एसएएम (Grounded-SAM) और नियंत्रण के लिए कैमरा ज्यामिति को एकीकृत करके, सघन मानचित्रण (dense mapping) के बिना, 8GB VRAM बजट के भीतर कुशल, ज़ीरो-शॉट स्वायत्त इनडोर नेविगेशन सक्षम करने के लिए विज़न-लैंग्वेज मॉडल तर्क को नियत विज़ुअल सर्वोइंग (deterministic visual servoing) के साथ जोड़ता है।

Alperen Avan, Jordi Sanchez-Riera2026-08-25
🤖 machine learning

Reward-Free Continual Adaptation for Resilient Space Robots

यह शोध पत्र एक रिवॉर्ड-फ्री (reward-free) निरंतर शिक्षण ढांचे को प्रस्तुत करता है जो अंतरिक्ष रोबोटों को गंभीर हार्डवेयर गिरावट के अनुकूल होने में सक्षम बनाता है, जिसमें अनसुपरवाइज्ड रोलआउट्स के माध्यम से ट्रांज़िशन डायनेमिक्स को अपडेट करने और कल्पित प्रक्षेप पथों (imagined trajectories) पर पॉलिसियों को प्रशिक्षित करने के लिए एक प्री-ट्रेंड लेटेंट-स्टेट वर्ल्ड मॉडल का लाभ उठाया जाता है, जिससे तैनाती के दौरान अव्यवहार्य रिवॉर्ड सिग्नल्स की आवश्यकता समाप्त हो जाती है।

Andrej Orsula, Miguel Olivares-Mendez, Carol Martinez2026-08-25
💻 computer science

GeoWAM: Visual Geometry World Action Models for Autonomous Driving

यह शोध पत्र GeoWAM को प्रस्तुत करता है, जो स्वायत्त ड्राइविंग (ऑटोनॉमस ड्राइविंग) के लिए एक वर्ल्ड एक्शन मॉडल है जो स्थानिक संरचना और गति को बेहतर ढंग से पकड़ने के लिए पिक्सेल-आधारित भविष्य के पूर्वानुमान के स्थान पर पॉइंट क्लाउड्स का उपयोग करके भविष्य के ज्यामिति पूर्वानुमान (फ्यूचर ज्योमेट्री फोरकास्टिंग) को प्रतिस्थापित करता है, जिसके परिणामस्वरूप इमेज-आधारित विकल्पों की तुलना में काफी अधिक मजबूत ड्राइविंग नीतियां प्राप्त होती हैं।

Yiren Lu, Xin Ye, Jiaming Liu, Jin Yao, Yi-chung Chen, Liam Merino, Dhruva Dixith Kurra, Min Cai, Tom Lampo, Yu Yin, Dan (…)2026-08-25
🤖 AI

Can you see how I learn? Human observers' inferences about Reinforcement Learning agents' learning processes

यह शोध पत्र इस बात की जांच करता है कि मानव पर्यवेक्षक एक नवीन अवलोकन-आधारित प्रतिमान के माध्यम से सुदृढीकरण अधिगम (Reinforcement Learning) एजेंटों की सीखने की प्रक्रियाओं का अनुमान कैसे लगाते हैं, जिसमें चार मुख्य व्याख्यात्मक विषयों (लक्ष्य, ज्ञान, निर्णय लेना और सीखने की प्रक्रियाएं) की पहचान की गई है जो अधिक पारदर्शी और व्याख्या योग्य मानव-रोबोट संपर्क प्रणालियों के डिजाइन को सूचित करने के लिए समय के साथ विकसित होते हैं।

Bernhard Hilpert, Muhan Hou, Kim Baraka, Joost Broekens2026-08-24
🔬 applied physics

Rapid Manufacturing of Lightweight Drone Frames Using Single-Tow Architected Composites

यह अध्ययन 3D फाइबर टेदरिंग (3DFiT) नामक एक तीव्र विनिर्माण विधि का प्रदर्शन करता है जो निरंतर सिंगल-टो फाइबर्स का उपयोग करके हल्के, उच्च-शक्ति वाले फेस सेंटर्ड क्यूबिक (FFC) लैटिस ड्रोन फ्रेम बनाता है, जो वाणिज्यिक समकक्षों की तुलना में वजन को 10% कम करते हुए और उड़ान के समय को तीन मिनट तक बढ़ाते हुए धातुओं और थर्मोप्लास्टिक्स की तुलना में चार से आठ गुना अधिक विशिष्ट शक्ति प्राप्त करते हैं।

Md Habib Ullah Khan, Kaiyue Deng, Ismail Mujtaba Khan, Kelvin Fu2026-08-24
💻 computer science

Humanoid Musical Robots as Experimental Interfaces for Music-Evoked Emotion

यह स्थिति पत्र संगीत-भावना अनुसंधान में पूर्व-रिकॉर्ड किए गए उद्दीपकों की सीमाओं को दूर करने के लिए मानवोयस (ह्यूमनॉइड) संगीतमय रोबोटों को नवीन प्रयोगात्मक इंटरफेस के रूप में उपयोग करने का प्रस्ताव करता है, जिससे बहुविध ध्वनिक, दृश्य और संवादात्मक चरों के नियंत्रित, पुनरुत्पादनीय हेरफेर को सक्षम किया जा सके, जैसा कि WAS-5 रोबोट के एक केस स्टडी के माध्यम से प्रदर्शित किया गया है।

Vincent K. M. Cheung, Jia-Yeu Lin2026-08-24
⚡ electrical engineering

Logic-VLA: A Temporal Logic Conditioned Vision-Language-Action Model

Logic-VLA एक नवीन विजन-लैंग्वेज-एक्शन मॉडल है जो एक सिंटैक्स-ग्राफ एनकोडर के माध्यम से सिग्नल टेम्पोरल लॉजिक विशिष्टताओं को एकीकृत करता है और एक दो-चरणीय अनुकूलन प्रक्रिया का उपयोग करता है ताकि प्राकृतिक भाषा निर्देशों पर उच्च प्रदर्शन बनाए रखते हुए रोबोटिक कार्यों में औपचारिक सुरक्षा और टेम्पोरल आवश्यकता की संतुष्टि में महत्वपूर्ण सुधार किया जा सके।

Celina Shiyu Wang, Yiqi Zhao, Junjie Ye, Yue Wang, Jyotirmoy V. Deshmukh2026-08-24
💻 computer science

Nonlinear Model Predictive Control for Trajectory Tracking of Differentially Flat Fixed-Wing Aerial Systems

यह शोध पत्र एक एकीकृत ढांचे का प्रस्ताव करता है जो तीव्र हवा के विक्षोभों के तहत फिक्स्ड-विंग यूएवी (UAVs) के लिए मजबूत, बाधा-जागरूक प्रक्षेपवक्र ट्रैकिंग प्राप्त करने हेतु डिफरेंशियल फ्लैटनेस-आधारित प्रक्षेपवक्र पीढ़ी को नॉनलीन मॉडल प्रेडिक्टिव कंट्रोल (NMPC) और एक नवीन पवन-जागरूक सैंपलिंग रणनीति के साथ एकीकृत करता है।

Nishanth Bobbili, Pratyaksh Rao, Luca Morando, Luca Masci, Giuseppe Loianno2026-08-24
🤖 machine learning

Rethinking Demonstration Unlearning in Imitation Learning for Robotics

यह शोध पत्र रोबोटिक्स इमिटेशन लर्निंग में प्रदर्शन अनलर्निंग (demonstration unlearning) के लिए एक रिट्रेन-कैलिब्रेटेड ऑडिट फ्रेमवर्क प्रस्तुत करता है जो संपादित नीतियों (edited policies) का मूल्यांकन दो अक्षों पर करता है—पूर्ण रिट्रेन के साथ व्यवहार संबंधी समानता और हटाए गए डेटा की उपस्थिति के साक्ष्य—ताकि महंगे रिट्रेनिंग के एक सांख्यिकीय रूप से कठोर, लागत प्रभावी विकल्प के रूप में कार्य किया जा सके।

Jiazhuo Li, Yu Zhang, Yiming Fei, Kangkang Dong, Xiaojun Zhu, Houde Liu, Jinze Tao2026-08-24