🤖 machine learning

Can Tabular Foundation Models Guide Exploration in Robot Policy Learning?

यह शोध पत्र TFM-S3 का प्रस्ताव करता है, जो एक नमूना-कुशल (sample-efficient) हाइब्रिड विधि है जो एक पूर्व-प्रशिक्षित टैबुलर फाउंडेशन मॉडल का लाभ उठाकर एक गतिशील रूप से अपडेट किए गए पॉलिसी सबस्पेस के भीतर वैश्विक अन्वेषण (global exploration) को निर्देशित करती है, जिससे मौजूदा बेसलाइनों की तुलना में उच्च-आयामी निरंतर रोबोट नियंत्रण (high-dimensional continuous robot control) में अभिसरण (convergence) को गति मिलती है और प्रदर्शन में सुधार होता है।

Buqing Ou, Frederike Dümbgen2026-05-01
💻 computer science

Learning-Based Hierarchical Scene Graph Matching for Robot Localization Leveraging Prior Maps

यह शोध पत्र पदानुक्रमित दृश्य ग्राफ मिलान (hierarchical scene graph matching) के लिए एक सीखे हुए, एंड-टू-एंड डिफरेंशिएबल पाइपलाइन को प्रस्तुत करता है जो मल्टी-लेवल सिमेंटिक संरचनाओं का लाभ उठाने के लिए बिल्डिंग इंफॉर्मेशन मॉडल्स (BIM) का उपयोग करता है ताकि कुशल, ज़ीरो-शॉट रोबोट लोकलाइजेशन को सक्षम किया जा सके, जो सटीकता और गति दोनों में मौजूदा कॉम्बिनेटोरियल बेसलाइन्स से बेहतर प्रदर्शन करता है।

Nimrod Millenium Ndulue, Jose Andres Millan-Romera, Matteo Giorgi, Holger Voos, Jose Luis Sanchez-Lopez2026-05-01
⚡ electrical engineering

Flying by Inference: Active Inference World Models for Adaptive UAV Swarms

यह शोध पत्र एक विशेषज्ञ-निर्देशित सक्रिय अनुमान (एक्टिव इन्फरेंस) ढांचे का प्रस्ताव करता है जो मल्टी-यूएवी (multi-UAV) प्रक्षेपवक्र नियोजन को एक संयोजन अनुकूलन समस्या से एक पदानुक्रमित संभावabilistic अनुमान कार्य में परिवर्तित करता है, जिससे अनुकूलन योग्य झुंड (स्वार्म्स) को ऑफलाइन ऑप्टिमाइज़र को पुन: चलाए बिना, विशेषज्ञ प्रदर्शनों से सीखने और संदर्भ वितरण से विचलन को कम करने के माध्यम से सुचारू, टकराव-जागरूक व्यवहार उत्पन्न करने में सक्षम बनाया जा सके।

Kaleem Arshid, Ali Krayani, Lucio Marcenaro, David Martin Gomez, Carlo Regazzoni2026-05-01
💻 computer science

FreeOcc: Training-Free Embodied Open-Vocabulary Occupancy Prediction

FreeOcc एक नवीन, प्रशिक्षण-मुक्त ढांचा है जो बिना किसी 3D एनोटेशन या ग्राउंड-ट्रुथ पोज़ की आवश्यकता के, मोनोक्यूलर या RGB-D अनुक्रमों से ओपन-वोकैबुलरी ऑक्यूपेंसी मैप जेनरेट करने के लिए एक चार-स्तरीय पाइपलाइन का लाभ उठाता है, और इनडोर बेंचमार्क पर अत्याधुनिक प्रदर्शन प्राप्त करता है।

Zeyu Jiang, Changqing Zhou, Xingxing Zuo, Changhao Chen2026-05-01
🤖 machine learning

FlexiTac: A Low-Cost, Open-Source, Scalable Tactile Sensing Solution for Robotic Systems

यह कार्य FlexiTac को प्रस्तुत करता है, जो एक कम लागत वाला, ओपन-सोर्स और स्केलेबल पीज़ोरेसिस्टिव (piezoresistive) स्पर्श संवेदन प्रणाली है, जिसमें लचीले सेंसर मैट और कॉम्पैक्ट इवैल्यूएशन इलेक्ट्रॉनिक्स शामिल हैं जो वास्तविक समय में डेटा अधिग्रहण को सक्षम करते हैं और विविध रोबोटिक प्लेटफॉर्मों के लिए उन्नत स्पर्श शिक्षण पाइपलाइनों का समर्थन करते हैं।

Binghao Huang, Yunzhu Li2026-05-01
🔬 materials science

NIMS-OS: An automation software to implement a closed loop between artificial intelligence and robotic experiments in materials science

NIMS-OS एक ओपन-सोर्स पायथन लाइब्रेरी और GUI एप्लिकेशन है जो इलेक्ट्रोलाइट्स जैसे नए पदार्थों की स्वायत्त खोज के लिए NAREE जैसे रोबोटिक प्रयोगात्मक प्रणालियों के साथ विविध AI एल्गोरिदम को एकीकृत करके पूर्णतः स्वचालित, क्लोज्ड-लूप सामग्री अनुसंधान को सक्षम बनाता है।

Ryo Tamura, Koji Tsuda, Shoichi Matsuda2026-04-30
🤖 AI

Speech-Gesture GAN: Gesture Generation for Robots and Embodied Agents

यह लेख एक स्पीच-जेस्चर-GAN फ्रेमवर्क का प्रस्ताव करता है जो एक सार्वजनिक डेटासेट से स्पीच टेक्स्ट, ऑडियो फीचर्स और जॉइंट एंगल्स के बीच के संबंधों को सीखकर, एम्बोडीड एजेंट्स के लिए यथार्थवादी को-स्पीच जेस्चर सीक्वेंस उत्पन्न करने के लिए एक कंडीशनल जेनरेटिव एडवरसैरियल नेटवर्क का उपयोग करता है।

Carson Yu Liu, Gelareh Mohammadi, Yang Song, Wafa Johal2026-04-30
🤖 AI

M2R2: MultiModal Robotic Representation for Temporal Action Segmentation

यह शोध पत्र M2R2 को प्रस्तुत करता है, जो एक नवीन मल्टीमॉडल फीचर एक्सट्रैक्टर है जो कई रोबोटिक डेटासेट्स में टेम्पोरल एक्शन सेगमेंटेशन के लिए अत्याधुनिक प्रदर्शन प्राप्त करने हेतु प्रोप्रियोसेप्टिव और एक्सटेरोसेप्टिव सेंसर डेटा को एक पुन: प्रयोज्य प्रशिक्षण रणनीति के साथ प्रभावी ढंग से संयोजित करता है।

Daniel Sliwowski, Dongheui Lee2026-04-30
🤖 AI

RetroMotion: Retrocausal Motion Forecasting Models are Instructable

रेट्रोमोशन (RetroMotion) एक ट्रांसफॉर्मर-आधारित मोशन फोरकास्टिंग मॉडल है जो एक रेट्रोकॉज़ल सूचना प्रवाह (retrocausal information flow) का उपयोग करके जटिल मल्टी-एजेंट भविष्यवाणियों को मार्जिनल और जॉइंट डिस्ट्रीब्यूशन में विभाजित करता है, जिससे प्रमुख डेटासेट्स पर अत्याधुनिक प्रदर्शन प्राप्त होता है और यह विशिष्ट रूप से सीन-एडेप्टिव इंस्ट्रक्शन फॉलोइंग का समर्थन करता है।

Royden Wagner, Omer Sahin Tas, Felix Hauser, Marlon Steiner, Dominik Strutz, Abhishek Vivekanandan, Jaime Villa, Yinzhe (…)2026-04-30
🤖 AI

Hybrid Diffusion for Simultaneous Symbolic and Continuous Planning

यह शोध पत्र एक नवीन हाइब्रिड डिफ्यूजन फ्रेमवर्क प्रस्तावित करके लॉन्ग-होराइज़न रोबोटिक कार्यों में मानक डिफ्यूजन मॉडल्स की सीमाओं को संबोधित करता है, जो उच्च-स्तरीय प्रतीकात्मक योजनाओं (सिंबोलिक प्लान्स) और निरंतर प्रक्षेप पथों (कंटीन्यूअस ट्राजेक्टरीज) को एक साथ उत्पन्न करता है, जिससे निर्णय लेने की क्षमता में सुधार होता है और लचीले, स्थिति-आधारित क्रिया संश्लेषण को सक्षम बनाया जाता है।

Sigmund Hennum Høeg, Aksel Vaaler, Chaoqi Liu, Olav Egeland, Yilun Du2026-04-30