🤖 machine learning

Dual Advantage Fields

यह शोधपत्र ड्यूल एडवांटेज फील्ड्स (DAF) का प्रस्ताव करता है, जो एक पॉलिसी-एक्सट्रैक्शन विधि है जो द्वैरेखीय (bilinear) ड्यूल वैल्यू मॉडल्स को लक्ष्य-निर्देशित फीचर विस्थापन (goal-directed feature displacements) के साथ उनके संरेखण के आधार पर क्रियाओं को स्कोर करके स्थानीय एडवांटेज संकेतों में परिवर्तित करती है, जिससे जटिल कार्यों पर ऑफलाइन गोल-कंडीशन्ड रिइन्फोर्समेंट लर्निंग के प्रदर्शन में सुधार होता है।

Alexey Zemtsov, Maxim Bobrin, Alexander Nikulin, Dmitry V. Dylov, Fakhri Karray, Vladislav Kurenkov, Martin Takáč, Arip (…)2026-06-04
💻 computer science

DLO-Lab: Benchmarking Deformable Linear Object Manipulations with Differentiable Physics

यह शोध पत्र DLO-Lab को प्रस्तुत करता है, जो एक बेंचमार्क सुइट है जिसमें एक डिफरेंशिएबल भौतिक सिम्युलेटर और एक विशेष एजेंट शामिल है, जिसे बहुमुखी सामग्री मॉडलिंग, रणनीतिक कार्य अपघटन और सिम-टू-रियल सत्यापन के माध्यम से विरूपण योग्य रैखिक वस्तुओं (deformable linear objects) के हेरफेर की स्केलेबिलिटी और सामान्यीकरण चुनौतियों को दूर करने के लिए डिज़ाइन किया गया है।

Junyi Cao, Yian Wang, Ziyan Xiong, Chunru Lin, Zhehuan Chen, Chuang Gan2026-06-04
🤖 AI

Instant-Fold: In-Context Imitation Learning for Deformable Object Manipulation

इंस्टेंट-फोल्ड (Instant-Fold) एक सिमुलेशन-प्रशिक्षित, इन-कॉन्टेक्स्ट इमिटेशन लर्निंग फ्रेमवर्क है जो बिना किसी ग्रेडिएंट अपडेट या अतिरिक्त फाइन-ट्यूनिंग की आवश्यकता के, एकल मानव प्रदर्शन से विविध निष्पादन मोड का अनुमान लगाकर, शून्य-शॉट वास्तविक दुनिया के विरूपणीय वस्तु हेरफेर (deformable object manipulation) को सक्षम बनाता है।

Yilong Wang, Cheng Qian, Edward Johns2026-06-04
💻 computer science

Think Fast and Far: Long-Horizon Online POMDP Planning via Rapid State Sampling

यह शोध पत्र ROP-RAS3 प्रस्तुत करता है, जो एक नवीन अनुमानित ऑनलाइन POMDP सॉल्वर है जो विविध मैक्रो-एक्शन उत्पन्न करने के लिए तीव्र स्टेट स्पेस सैंपलिंग का लाभ उठाता है, जिससे उच्च-आयामी निरंतर और हाइब्रिड वातावरण में कुशल दीर्घ-क्षितिज़ (long-horizon) योजना सक्षम होती है जहाँ यह सफलता दर में अत्याधुनिक तरीकों से काफी बेहतर प्रदर्शन करता है।

Yuanchu Liang, Edward Kim, J. Arden Knoll, Wil Thomason, Zachary Kingston, Lydia E. Kavraki, Hanna Kurniawati2026-06-04✓ Author reviewed ⓘ
💻 computer science

3DThinkVLA: Endowing Vision-Language-Action Models with Latent 3D Priors via 3D-Thinking-Guided Co-training

यह शोध पत्र 3DThinkVLA का प्रस्ताव करता है, जो एक को-ट्रेनिंग फ्रेमवर्क है जो विजन-लैंग्वेज-एक्शन मॉडल्स को लेटेंट ज्योमेट्रिक प्रायर्स और स्पेशियल रीजनिंग को डिसेंटैंगल और एक्शन प्रेडिक्शन प्रक्रिया में इंजेक्ट करके निहित 3D रीजनिंग क्षमताओं से सुसज्जित करता है, जिससे बिना किसी 3D सेंसर या डिप्लॉयमेंट के दौरान स्पष्ट टेक्स्ट जनरेशन की आवश्यकता के, केवल 2D इमेज का उपयोग करके मैनिपुलेशन कार्यों पर अत्याधुनिक प्रदर्शन सक्षम होता है।

Jiaxin Shi, Xidong Zhang, Fucai Zhu, Zhe Li, Siyu Zhu, Weihao Yuan2026-06-04
💻 computer science

BPDA-GMM: Bayesian Probabilistic Data Association via Gaussian Mixture Models for Semantic SLAM

यह शोध पत्र BPDA-GMM का प्रस्ताव करता है, जो एक ऑनलाइन बेयसियन संभाव्य डेटा एसोसिएशन ढांचा है जो बढ़ते ऑब्जेक्ट-स्तरीय मानचित्र के साथ सुदृढ़ सिमेंटिक SLAM को सक्षम करने के लिए डिरिचलेट-प्रोसेस प्रायर और गॉसियन मिश्रण मॉडल का उपयोग करता है, जो क्लोज्ड-फॉर्म अपडेट और एक डीकप्ल्ड बैक-एंड के माध्यम से संवेदी एलिएसिंग और क्लासिफायर त्रुटियों को प्रभावी ढंग से संबोधित करता है।

Thanh Nguyen Canh, Haolan Zhang, Xiem HoangVan, Antonio Sgorbissa, Nak Young Chong2026-06-04
💻 computer science

Real-World Deployment of a 5G-Connected Edge-Controlled Aerial Robot in Industrial Subterranean Mines

यह शोध पत्र एक सक्रिय औद्योगिक भूमिगत खान (सबटेरेनियन माइन) में 5G स्टैंडअलोन नेटवर्क के माध्यम से एक स्वायत्त हवाई रोबोट के नेविगेशन का पहला वास्तविक-विश्व प्रदर्शन प्रस्तुत करता है, जो मानव-चयनित वेपॉइंट्स से सुरक्षित, टकराव-मुक्त पथ उत्पन्न करने के लिए मॉडल प्रेडिक्टिव कंट्रोलर को होस्ट करने हेतु कुबेरनेट्स-आधारित एज क्लस्टर का उपयोग करता है।

Achilleas Santi Seisa, Emanuele Pagliari, Gerasimos Damigos, Elias Small, George Nikolakopoulos2026-06-04
⚡ electrical engineering

Exploiting the Passive Dynamics of a Compliant Leg to Develop Gait Transitions

यह शोध पत्र स्प्रिंग-लोडेड इनवर्टेड पेंडुलम (SLIP) मॉडल का विश्लेषण करने के लिए एक हाइब्रिड डायनामिकल सिस्टम्स फ्रेमवर्क का उपयोग करता है, जो स्थिरता क्षेत्रों की पहचान करता है और यह प्रदर्शित करता है कि कैसे सरल गैर-स्थिर आक्रमण कोण (angle of attack) नियंत्रण नीतियों के माध्यम से निरंतर-ऊर्जा चाल संक्रमणों के लिए अस्थिर गतिकी का लाभ उठाया जाए और लगभग सार्वभौमिक स्थिरता प्राप्त की जाए।

Harold Roberto Martinez Salazar, Juan Pablo Carbajal2026-06-03
🤖 AI

Assistax: A Multi-Agent Hardware-Accelerated Reinforcement Learning Benchmark for Assistive Robotics

Assistax एक ओपन-सोर्स, मल्टी-एजेंट रीइन्फोर्समेंट लर्निंग बेंचमार्क है जो सहायक रोबोटिक्स (assistive robotics) के लिए है और यह CPU-आधारित विकल्पों की तुलना में 370 गुना तक तेज़ प्रशिक्षण गति प्राप्त करने के लिए JAX हार्डवेयर एक्सेलेरेशन का लाभ उठाता है, जबकि यह रोबोटिक एजेंटों और विविध मानव भागीदारों के बीच ज़ीरो-शॉट कोऑर्डिनेशन का मूल्यांकन करता है।

Leonard Hinckeldey, Elliot Fosong, Rimvydas Rubavicius, Elle Miller, Trevor McInroe, Fan Zhang, Patricia Wollstadt, Stef (…)2026-06-03
⚡ electrical engineering

BEAVR: Bimanual, multi-Embodiment, Accessible, Virtual Reality Teleoperation System for Robots

BEAVR एक ओपन-सोर्स, द्वि-हस्त (bimanual), बहु-देह (multi-embodiment) वर्चुअल रियलिटी टेलीऑपरेशन सिस्टम है जो विविध रोबोटिक प्लेटफॉर्म्स के बीच कम विलंबता (low latency) और अग्रणी विज़ुओमोटर पॉलिसियों के साथ अनुकूलता के साथ रीयल-टाइम नियंत्रण, डेटा रिकॉर्डिंग और पॉलिसी लर्निंग को एकीकृत करता है।

Alejandro Posadas-Nava, Alejandro Carrasco, Richard Linares2026-06-03