🤖 machine learning

ConTraIRL: Factorized Contrastive Abstractions for Transferable IRL

यह शोध पत्र ConTraIRL का प्रस्ताव करता है, जो एक ड्यूल-एनकोडर आर्किटेक्चर और कंट्रास्टिव ऑब्जेक्टिव्स का उपयोग करके इन्वर्स रिइन्फोर्समेंट लर्निंग में विश्वसनीय रिवॉर्ड ट्रांसफर प्राप्त करने वाला एक फ्रेमवर्क है, जिससे एनवायरनमेंट डायनेमिक्स और टास्क गोल्स के डिकपल्ड लेटेंट रिप्रेजेंटेशन को सीखने में मदद मिलती है, जो अंततः अनदेखे पेयरिंग्स के लिए प्रभावी कंपोजिशनल जनरलाइजेशन को सक्षम बनाता है।

Yikang Gui, Bikramjit Banerjee, Prashant Doshi2026-06-03
💻 computer science

ModuLoop : Low-Level Code Generation using Modular Synthesizer and Closed-Loop Debugger for Robotic Control

यह शोध पत्र ModuLoop को प्रस्तुत करता है, जो एक क्लोज्ड-लूप फ्रेमवर्क है जो रोबोटिक कार्यों के लिए सटीक, निष्पादन योग्य लो-लेवल कंट्रोल प्रोग्राम उत्पन्न करने के लिए टास्क-विशिष्ट फाइन-ट्यूनिंग की आवश्यकता के बिना, मॉड्यूलर कोड प्लानिंग और इटरेटिव डीबगिंग के लिए प्री-ट्रेंड लार्ज लैंग्वेज मॉडल्स का लाभ उठाता है।

Gina Yoon, Sumin Lee, Joo Yong Sim2026-06-03
🤖 AI

NVIDIA OmniDreams: Real-Time Generative World Model for Closed-Loop Autonomous Vehicle Simulation

NVIDIA OmniDreams एक वास्तविक समय (real-time) का, फाउंडेशन जनरेटिव वर्ल्ड मॉडल है जो कॉसमॉस डिफ्यूजन आर्किटेक्चर पर निर्मित है और जो पारंपरिक सिम्युलेटरों की सामान्यीकरण सीमाओं को पार करता है, क्योंकि यह क्लोज्ड-लूप स्वायत्त वाहन प्रशिक्षण और मूल्यांकन के लिए ऑटोरेग्रेसिव रूप से फोटोरियलिस्टिक, एक्शन-कंडीशन्ड सेंसर ऑब्जर्वेशन को सिंथेसाइज करता है।

NVIDIA, :, Aarti Basant, Amlan Kar, Despoina Paschalidou, Fangyin Wei, Francesco Ferroni, Guillermo Garcia Cobo, Haithe (…)2026-06-03
💻 computer science

Ask When It Pays: Cost-Aware Open-Ended Interaction for Instance Goal Navigation

यह शोध पत्र इंस्टेंस गोल नेविगेशन (Instance Goal Navigation) को एक लागत-संवेदनशील अनिश्चितता-न्यूनीकरण समस्या के रूप में पुनर्गठित करके पूर्ववर्ती संवादात्मक नेविगेशन विधियों की अक्षमता को संबोधित करता है, जिसमें एक नया बेंचमार्क एक लागत-जागरूक मीट्रिक के साथ और एक ज़ीरो-शॉट एमएलएलएम (MLLM) नेविगेटर पेश किया गया है जो केवल तभी एक ओरेकल (oracle) से प्रश्न पूछता है जब अपेक्षित सूचना लाभ (information gain) इंटरेक्शन लागत को न्यायसंगत ठहराता है।

Xunyi Zhao, Sihao Lin, Gengze Zhou, Zerui Li, Shijie Li, Wei Tao, Jiajun Liu, Qi Wu2026-06-03
💻 computer science

ConTrack: Constrained Hand Motion Tracking with Adaptive Trade-off Control

ConTrack एक सुदृढीकरण शिक्षण (reinforcement learning) ढांचा है जो ऑब्जेक्ट ट्रैकिंग को एक बाधा के रूप में मानकर और उच्च सफलता दर एवं पोज़ सटीकता प्राप्त करने के लिए अनुकूली ट्रेड-ऑफ नियंत्रण (adaptive trade-off control) और मिड-ट्रैजेक्टरी रीसेट का उपयोग करके, प्रदर्शित जॉइंट मोशन और कॉन्टैक्ट टाइमिंग को सुरक्षित रखते हुए दीर्घ-क्षितिज (long-horizon), संपर्क-समृद्ध (contact-rich) डेक्सट्रस मैनिपुलेशन में सुधार करता है।

Yutong Liang, Quanquan Peng, Ri-Zhao Qiu, Xiaolong Wang2026-06-03
⚡ electrical engineering

Toward Gripper-Integrated Active Electrosense for Pre-Contact Sensing in Underwater Soft Grippers

यह शोध पत्र पानी के नीचे वाले सॉफ्ट रोबोट्स के लिए एक ग्रिपर-एकीकृत सक्रिय इलेक्ट्रोसेंस (electrosense) प्रणाली का प्रस्ताव और सत्यापन करता है, जो यह प्रदर्शित करता है कि मल्टी-इलेक्ट्रोड वोल्टेज माप उन धुंधले वातावरणों में संपर्क से पूर्व ही प्रवाहकीय वस्तुओं का प्रभावी ढंग से पता लगा सकते हैं जहाँ दृष्टि (vision) विफल हो जाती है।

Ahsan Tanveer, Muhammad Hamza, Waqar Hussain Afridi, Chen Wang, Guangming Xie2026-06-03
💻 computer science

GeoAlign: Beyond Semantics with State-Guided Spatial Alignment in VLA Models

GeoAlign विजन-लैंग्वेज-एक्शन मॉडल्स के लिए एक स्टेट-गाइडेड स्पेशियल अलाइनमेंट आर्किटेक्चर पेश करता है जो रोबोट-डोमेन RGB-D सुपरविजन के साथ एक RGB ब्रांच को पोस्ट-ट्रेन करके ज्योमेट्री-अवेयर फीचर्स जेनरेट करता है जिन्हें प्रोप्रियोसेप्टिव स्टेट्स द्वारा क्वेरी किया जाता है, जिससे मैनिपुलेशन परफॉरमेंस में सुधार होता है और सिम्युलेटेड एवं रियल-वर्ल्ड दोनों बेंचमार्क्स पर स्टेट-ऑफ-द-आर्ट परिणाम प्राप्त होते हैं।

Yizhi Chen, Zhanxiang Cao, Xinyi Peng, Yixiao Zheng, Xiaxi Si, Yiheng Li, Liyun Yan, Keqi Zhu, Xueyun Chen, Shengcheng F (…)2026-06-03
💻 computer science

GPU-Parallel Multi-Task Reinforcement Learning with Demonstration Guided Policy Optimization

यह शोध पत्र संरचित हेरफेर कार्यों (structured manipulation tasks) के लिए एक GPU-समानांतर मल्टी-टास्क सुदृढीकरण शिक्षण (reinforcement learning) बेंचमार्क, MT-Libero को प्रस्तुत करता है, और DGPO का प्रस्ताव करता है, जो एक ऑन-पॉलिसी प्रदर्शन-निर्देशित विधि है जो स्पार्स रिवार्ड्स (sparse rewards) के तहत विषम कार्य सूट्स को प्रभावी ढंग से प्रशिक्षित करने के लिए इम्पोर्टेंस-वेटेड PPO को एडेप्टिव बिहेवियर क्लोनिंग के साथ जोड़ती है।

Rui Zhang, Qiwei Wu, Zhengyu Zhang, Tao Li, Yunrong Guo, Junjie Lai, Renjing Xu, Weihua Zhang2026-06-03
💻 computer science

Extreme Motion Generation via Hybrid Null-Space Control for Straight-Line Path Following

यह शोध पत्र एक हाइब्रिड नल-स्पेस कंट्रोल फ्रेमवर्क प्रस्तावित करता है जो एक कंडीशनल डिफ्यूजन-आधारित इनिशियल कॉन्फ़िगरेशन सैंपलर, लॉन्ग-होरिज़ॉन निर्णय लेने के लिए एक रिइन्फोर्समेंट लर्निंग पॉलिसी, और सीमा के निकट सुरक्षा के लिए एक क्लासिकल मॉडल-आधारित कंट्रोलर को जोड़ता है ताकि फिक्स्ड-बेस मैनिपुलेटर्स की उनकी किनेमैटिक सीमाओं के भीतर सीधी रेखा पथ-अनुसरण (straight-line path-following) क्षमताओं को महत्वपूर्ण रूप से बढ़ाया जा सके।

Xinyi Yuan, Weiwei Wan, Kensuke Harada2026-06-03
💻 computer science

OpenEAI-Platform: An Open-source Embodied Artificial Intelligence Hardware-Software Unified Platform

यह शोध पत्र OpenEAI-Platform को प्रस्तुत करता है, जो एक पूर्णतः ओपन-सोर्स हार्डवेयर-सॉफ्टवेयर एकीकृत प्रणाली है जिसमें एक कम लागत वाला, उच्च-सटीक 6+1-dof रोबोटिक आर्म और एक पुनरुत्पादित विजन-लैंग्वेज-एक्शन मॉडल शामिल है जो केवल ओपन-सोर्स डेटा का उपयोग करके व्यावसायिक आर्म्स और बड़े पैमाने के बेसलाइन्स के तुलनीय प्रदर्शन प्राप्त करता है।

Jinyuan Zhang, Luoyi Fan, Leiyu Wang, Yeqiang Wang, Yicheng Zhu, Cewu Lu, Nanyang Ye2026-06-03