💻 computer science

Dense to MoE Adaptation for Compact Vision Language Action Policies

यह शोध पत्र AdaDE को प्रस्तुत करता है, जो एक ऐसी विधि है जो विजन लैंग्वेज एक्शन (VLA) पॉलिसियों में डेंस फीड-फॉरवर्ड ब्लॉक्स को डायनेमिक एक्सपर्ट डीएक्टिवेशन के साथ मिक्सचर ऑफ एक्सपर्ट्स (MoE) लेयर्स में अनुकूलित करती है, जो संसाधन-सीमित रोबोट प्लेटफॉर्म पर उच्च कार्य सफलता दर बनाए रखते हुए सक्रिय LLM मापदंडों को 40% तक सफलतापूर्वक कम करती है।

Muchun Niu, Shuang Chen, Yuzhou Wu, Xiaobing Tu, Yinggui Wang, Jinkui Ren, Xiantao Zhang, Linfeng Zhang2026-09-21
🤖 machine learning

ASGARD: Action-Space Guard for UAV Resilience via Reinforcement Learning

यह शोध पत्र ASGARD को प्रस्तुत करता है, जो एक दो-चरणीय शिक्षक-छात्र ढांचा (teacher-student framework) है, जो केवल भौतिक अवस्था के इतिहास (physical state history) का उपयोग करके सुधारा गया एक्शन कमांड उत्पन्न करने के लिए एक मॉनिटर को प्रशिक्षित करके, रनटाइम एक्शन-स्पेस हमलों के विरुद्ध सुदृढीकरण लर्निंग (Reinforcement Learning) आधारित UAV नियंत्रकों की लचीलापन (resilience) को बढ़ाता है।

Mohsen Salehi, Karthik Pattabiraman2026-09-21
🔢 mathematics

Square Root Gauss-Newton iLQR

यह शोध पत्र एक संख्यात्मक रूप से सुदृढ़ और एल्गोरिदम के स्तर पर सरल 'स्क्वायर रूट गॉस-न्यूटन iLQR' सूत्रीकरण प्रस्तुत करता है जो लागत फलन (cost function) की भारित न्यूनतम-वर्ग (weighted least-squares) संरचना का लाभ उठाता है ताकि एकल क्यूआर-अपघटन (QR-decompositions) पर आधारित एक बैकवर्ड पास को सक्षम बनाया जा सके, जिससे विशेष रूप से बाधित प्रक्षेपवक्र अनुकूलन (constrained trajectory optimization) के लिए संवर्धित लैग्रेंजियन ढांचों (augmented Lagrangian frameworks) के भीतर अनुकूलन क्षमता (conditioning) और स्थिरता में सुधार होता है।

Maximilian Haas-Heger, Jur van den Berg2026-09-21
🤖 AI

PlantShade: Predicting Plant Shadows for Lighting-Aware Robotic Agricultural Operation

यह शोध पत्र गतिशील प्रकाश स्थितियों के साथ एक व्यापक बहु-प्रजाति डेटासेट पेश करके और धारणा (परसेप्शन) एवं प्रकाश नियंत्रण जैसे डाउनस्ट्रीम कार्यों को बढ़ाने के लिए यथार्थवादी, टेम्पोरली कंडिश्न्ड शैडो सिमुलेशन हेतु एक डिफ्यूजन-आधारित जनरेटिव मॉडल प्रस्तावित करके कृषि रोबोटिक्स में पौधों की छाया की जटिलता को संबोधित करता है।

Longchao Da, Xiaoou Liu, Xingjian Li, Lirong Xiang, Hua Wei2026-09-21
🤖 machine learning

Talk to Me, Jarvis: An Open-Source Edge-Deployable Voice Assistant Framework for Autonomous Racecars

यह शोध पत्र जार्विस (Jarvis) को प्रस्तुत करता है, जो स्वायत्त रेसकारों के लिए एक ओपन-सोर्स, एज-डिप्लॉय करने योग्य वॉयस असिस्टेंट फ्रेमवर्क है, जो ऑनलाइन-होस्टेड समाधानों की नेटवर्क निर्भरता और इन्फरेंस विलंबता को समाप्त करने के लिए उच्च-सटीक इरादा पहचान (intent recognition) प्राप्त करने हेतु स्थानीय रूप से फाइन-ट्यून किए गए मिस्ट्रल 7B (Mistral 7B) मॉडल का उपयोग करता है।

Daniel Henel, Frederik Werner, Alexander Langmann, Johannes Betz2026-09-21
💻 computer science

MetaPusher: Meta Learning and Planning for Nonprehensile Manipulation of Unseen Objects with Rapid Online Adaption

MetaPusher एक मेटा-लर्निंग और एडेप्टिव प्लानिंग फ्रेमवर्क है जो एक मेटा-लर्न्ड डायनेमिक्स मॉडल को एक ट्री-रियूजिंग काइनोडायनेमिक प्लानर के साथ जोड़कर अनदेखे ऑब्जेक्ट्स के नॉनप्रेहेन्साइल मैनिपुलेशन के लिए तीव्र ऑनलाइन अनुकूलन और कुशल लॉन्ग-होरिज़न प्लानिंग को सक्षम बनाता है, जिससे बिना किसी पूर्व ऑब्जेक्ट-विशिष्ट इंटरैक्शन के उत्कृष्ट कार्य सफलता दर प्राप्त होती है।

Donghyung Lee, Seyedali Golestaneh, Jaskrit Singh, Zhuoyun Zhong, Athanasios Kapoutsis, Constantinos Chamzas2026-09-21
🤖 AI

Visual Navigation Transformer with Pose Attention

यह शोध पत्र VNT-PA का प्रस्ताव करता है, जो एक ट्रांसफॉर्मर-आधारित नेविगेशन प्लैनर है जो डेप्थ कीफ्रेम्स को इंडेक्स करने के लिए कैमरा पोज़ेस को पोजीशनल एनकोडिंग के रूप में उपयोग करता है, जिससे विभिन्न प्रक्षेप पथों (ट्रैजेक्टरीज) में स्थानिक अनुभव का कुशल पुन: उपयोग सक्षम होता है और लॉन्ग-होरिजन पॉइंट-गोल नेविगेशन में अत्याधुनिक प्रदर्शन प्राप्त होता है।

Beiming Li, Jaime Romero, Jonathan Diller, Vijay Kumar, Alejandro Ribeiro2026-09-21
⚡ electrical engineering

VLA-Scope: Shift-Aware Failure Prediction for Vision-Language-Action Models

यह शोध पत्र VLA-Scope को प्रस्तुत करता है, जो एक दो-चरणीय ढांचा है जो इनपुट-शिफ्ट लक्षण वर्णन को निष्पादन इतिहास और एक्शन विशेषताओं के साथ जोड़कर रोबोटिक रोलआउट के दौरान विफलता जोखिम को गतिशील रूप से अपडेट करके विजन-लैंग्वेज-एक्शन मॉडल के लिए वितरण बदलावों (distribution shifts) के तहत विफलता की भविष्यवाणी को बढ़ाता है।

Kaiwen Zhu, Dongfang Liu, Liangkai Liu2026-09-21
💻 computer science

LOInK: Learned Optimal Inverse Kinematics via Structured Neural Surrogate Models

LOInK एक डेटा-संचालित विधि है जो एक संरचित लेटेंट स्पेस (latent space) में एक bi-Lipschitz व्युत्क्रमणीय मैपिंग (invertible mapping) सीखती है जहाँ लागत-न्यूनतम समाधान मूल बिंदु (origin) पर स्थित होते हैं, जिससे पारंपरिक बाधा-आधारित अनुकूलन दृष्टिकोणों की तुलना में काफी तेज़ी से निकट-इष्टतम इन्वर्स किनेमैटिक्स समाधानों का कुशल उत्पादन संभव हो पाता है।

Michael Somerfield, Damian Abood, Ruigang Wang, Ian R. Manchester2026-09-21
💻 computer science

MarineCraft: Enabling Rapid Prototyping of Underwater Robots via Modular Construction

यह शोध पत्र MarineCraft को प्रस्तुत करता है, जो एक मॉड्यूलर टूलकिट है जिसमें स्व-निहित वाटरप्रूफ प्रोपल्शन इकाइयाँ शामिल हैं जो केंद्रीकृत वायरिंग को समाप्त करती हैं ताकि विविध अंतर्जलीय रोबोट ज्यामितियों के तीव्र संयोजन और परीक्षण को सक्षम बनाया जा सके, जिससे विश्वसनीय लीक-मुक्त प्रदर्शन बनाए रखते हुए प्रोटोटाइपिंग की प्रक्रिया को महत्वपूर्ण रूप से तेज किया जा सके।

Yuta Sugiura2026-09-21