🤖 AI

ProCompNav: Proactive Instance Navigation with Comparative Judgment for Ambiguous User Queries

ProCompNav एक दो-चरणीय ढांचा है जो एक उम्मीदवार पूल (candidate pool) को पुनरावृत्ति से निर्मित करके और लक्ष्य को विचलित करने वाले तत्वों (distractors) से कुशलतापूर्वक अलग करने के लिए बाइनरी तुलनात्मक प्रश्नों का उपयोग करके अस्पष्ट इंस्टेंस नेविगेशन प्रश्नों को हल करता है, जिससे यह सफलता दर में मौजूदा विधियों से बेहतर प्रदर्शन करते हुए उपयोगकर्ता प्रतिक्रिया की लंबाई को महत्वपूर्ण रूप से कम करता है।

Junhyuk Kwon, Seungjoon Lee, Hyejin Park, Kyle Min, Jungseul Ok2026-05-18
💻 computer science

Diffusion Policy for Coordinated Control of a Nonholonomic Mobile Base and Dual Arms in Door Opening and Passing

यह शोधपत्र एक डिफ्यूजन-आधारित विसुओमोटर नियंत्रण नीति प्रस्तुत करता है जो दो भुजाओं वाले एक नॉनहोलोनोमिक मोबाइल बेस को भारी स्व-बंद होने वाले दरवाजों को खोलने और उनसे गुजरने के जटिल, दीर्घ-क्षितिज वाले कार्य को मजबूती से और समन्वयात्मक रूप से निष्पादित करने में सक्षम बनाता है, जो सामान्यीकरण और विक्षोभ प्रबंधन में पारंपरिक स्टेट-मशीन दृष्टिकोणों से बेहतर प्रदर्शन करता है।

Shangqun Yu, Matthew En, Daniel Wu, Sangjun Park, Ziyi Zhou, Seyed Fakoorian, Donghyun Kim2026-05-18
🤖 AI

Hybrid LLM-based Intelligent Framework for Robot Task Scheduling

यह शोध पत्र दो लार्ज लैंग्वेज मॉडल एजेंटों (एक जनरेटर और एक सुपरवाइजर) का उपयोग करने वाले एक हाइब्रिड फ्रेमवर्क का प्रस्ताव करता है ताकि समय और संसाधनों को संतुलित करके, प्राकृतिक भाषा इंटरफेस के माध्यम से वास्तविक समय की साइट स्थितियों के अनुकूल होकर, और प्रयोगात्मक मूल्यांकन के माध्यम से प्रभावकारिता प्रदर्शित करके निर्माण रोबोट कार्य शेड्यूलिंग को अनुकूलित किया जा सके।

Swayamjit Saha, Subhabrata Das, Haonan Duan, Xiao-Yang Liu2026-05-18
💻 computer science

LAPS: Improving Incremental LiDAR Mapping using Active Pooling and Sampling for Neural Distance Fields

यह शोध पत्र LAPS का प्रस्ताव करता है, जो एक रिप्ले मैनेजमेंट फ्रेमवर्क है जो कैटास्ट्रोफिक फॉरगेटिंग (विस्मृति) को कम करने और पुनर्निर्माण की पूर्णता में सुधार करने के लिए रिलायबिलिटी-आधारित एक्टिव पूलिंग और अनसर्टेन्टी-गाइडेड एक्टिव सैंपलिंग को जोड़कर न्यूरल डिस्टेंस फील्ड्स का उपयोग करके इंक्रीमेंटल LiDAR मैपिंग को बढ़ाता है।

Dongjae Lee, Wooseong Yang, Yifu Tao, Maurice Fallon, Ayoung Kim2026-05-18
⚡ electrical engineering

Terrain Consistent Reference-Guided RL for Humanoid Navigation Autonomy

यह शोध पत्र एक संदर्भ-निर्देशित सुदृढीकरण शिक्षण (रिफरेंस-गाइडेड रीइन्फोर्समेंट लर्निंग) विधि प्रस्तुत करता है जो प्रशिक्षण प्रक्षेप पथों को स्थलाकृति की ज्यामिति के अनुरूप नियंत्रित करती है, जिससे एक यूनिट्री G1 ह्यूमनॉइड रोबोट केवल ऑनबोर्ड सेंसिंग और कंप्यूटेशन का उपयोग करके ऊबड़-खाबड़ इलाके और सीढ़ियों पर मजबूत, दीर्घकालिक स्वायत्त नेविगेशन प्राप्त करने में सक्षम होता है।

William D. Compton, Zachary Olkin, Aaron D. Ames2026-05-18
💻 computer science

KaRMA: A Kinematic Metric for Fine Manipulation Ability in Robotic Hands

यह शोध पत्र KaRMA को प्रस्तुत करता है, जो एक केवल-काइनेमैटिक (kinematic-only) मीट्रिक है जो व्यवहार्य रोलिंग गतियों के माध्यम से एक गोलाकार वस्तु के सुलभ इन-हैंड ट्रांसलेशन और रीओरिएंटेशन को मापकर रोबोटिक हाथों की सूक्ष्म हेरफेर क्षमता को परिमाणित करता है, जो निपुणता को अलग करने और मौजूदा बेसलाइन के लिए अदृश्य ट्रेडऑफ्स को प्रकट करने में पारंपरिक स्थिर मीट्रिक्स पर अपनी श्रेष्ठता प्रदर्शित करता है।

Martin Peticco, Pulkit Agrawal2026-05-18
🤖 machine learning

CM-EVS: Sparse Panoramic RGB-D-Pose Data for Complete Scene Coverage

यह शोध पत्र CM-EVS को प्रस्तुत करता है, जो विविध 3D एसेट्स से प्राप्त एक स्पार्स पैनोरमिक RGB-D-pose डेटासेट है, जिसे प्रशिक्षण-मुक्त COVER एल्गोरिदम का उपयोग करके तैयार किया गया है, जो 3D विजुअल लर्निंग के लिए न्यूनतम रेडंडेंसी और ऑडिट करने योग्य प्रोवेनेंस के साथ पूर्ण दृश्य कवरेज सुनिश्चित करने हेतु ज्यामितीय रूप से सुसंगत व्यू पॉइंट्स को कुशलतापूर्वक क्यूरेट करता है।

Jiale Liu, Jungang Li, Jieming Yu, Xinglin Yu, Zihao Dongfang, Zongjian Ding, Kaifeng Ding, Yi Yang, Lidong Chen, Yang Z (…)2026-05-18
💻 computer science

MyoChallenge 2025: A New Benchmark for Human Athletic Intelligence

MyoChallenge 2025 एक NeurIPS बेंचमार्क है जो ऊपरी और निचले अंग के खेल कार्यों के माध्यम से मोटर नियंत्रण बुद्धिमत्ता का मूल्यांकन करने और उसे उन्नत करने के लिए उच्च-निष्ठा वाले मस्कुलोस्केलेटल सिमुलेशन और मशीन लर्निंग का लाभ उठाता है, जो रोबोटिक्स, बायोमैकेनिक्स और न्यूरोसाइंस के बीच की दूरियों को पाटने के लिए एक वैश्विक अंतरविषयक समुदाय को एकजुट करता है।

Cheryl Wang, Chun Kwang Tan, Balint K. Hodossy, Eric Lyu, Jun Guo, Wentao Zhao, Huaping Liu, Chengkun Li, Merkourios Sim (…)2026-05-18
🤖 AI

DiLA: Disentangled Latent Action World Models

DiLA एक नवीन वर्ल्ड मॉडल पेश करता है जो लेबल किए गए डेटा की आवश्यकता के बिना उच्च-गुणवत्ता वाले वीडियो जनरेशन और व्याख्यात्मक एक्शन स्पेस को प्राप्त करने के लिए लेटेंट एक्शन लर्निंग और कंटेंट-स्ट्रक्चर डिसेंटैंगलमेंट के बीच तालमेल का लाभ उठाकर एक्शन एब्स्ट्रैक्शन और जनरेशन फिडेलिटी के बीच के ट्रेड-ऑफ को हल करता है।

Tianqiu Zhang, Muyang Lyu, Yufan Zhang, Fang Fang, Si Wu2026-05-18
🤖 AI

A Topology-Aware Spatiotemporal Handover Framework for Continuous Multi-UAV Tracking

यह शोध पत्र एक वास्तविक समय, टोपोलॉजी-जागरूक स्पैटियोटेम्पोरल हैंडओवर फ्रेमवर्क प्रस्तावित करता है जो मल्टी-यूएवी (multi-UAV) फील्ड ऑफ व्यू में 99.8% पहचान निरंतरता प्राप्त करने के लिए ज्यामितीय ओवरलैप और वर्चुअल लेन विविक्तीकरण (virtual lane discretization) का लाभ उठाता है, जो इंटेलिजेंट ट्रांसपोर्टेशन सिस्टम में निरंतर मल्टी-व्हीकल ट्रैकिंग के लिए अपीयरेंस-आधारित री-आइडेंटिफिकेशन विधियों से काफी बेहतर प्रदर्शन करता है।

Jianlin Ye, Christos Kyrkou, Panayiotis Kolios2026-05-18