💻 computer science

Efficient Computation of Distance Functions for Navigation Vector Fields in Lie Groups

यह शोध पत्र ली समूह (Lie groups) में बिंदुओं और G-पॉलीनोमियल वक्रों के बीच की दूरियों की गणना करने के लिए एक कुशल विधि प्रस्तावित करता है, जो समस्या को पॉलीनोमियल रूट-फाइंडिंग (polynomial root-finding) में बदलने के लिए उनकी संरचना का लाभ उठाता है, जिससे मौजूदा अनुकूलन-आधारित दृष्टिकोणों की तुलना में वास्तविक समय की रोबोट नेविगेशन के लिए कम्प्यूटेशनल लागत काफी कम हो जाती है।

Vinicius M. Gonçalves, João Baião, Felipe Bartelt, Douglas G. Macharet, Gustavo M. Freitas, Héctor Azpúrua, Luciano C. A (…)2026-06-05
💻 computer science

VASO: Formally Verifiable Self-Evolving Skills for Physical AI Agents

VASO एक नवीन ढांचा है जो औपचारिक सत्यापन (formal verification) के माध्यम से LLM-जनित रोबोट कौशल अनुबंधों के स्व-विकास को सक्षम बनाता है, जो फाउंडेशन मॉडल के भार (weights) को संशोधित किए बिना, काउंटरएग्ज़ाम्पल्स (counterexamples) का उपयोग करके टेम्पोरल सुरक्षा विशिष्टताओं (temporal safety specifications) के विरुद्ध पुन: प्रयोज्य कौशलों को पुनरावृत्ति से परिष्कृत करता है, जिससे न्यूनतम अनुकूलन नमूनों (optimization samples) के साथ भौतिक एजेंटों पर उच्च अनुपालन प्राप्त होता है।

Yunhao Yang, Neel P. Bhatt, Kevin Wang, Samuel Tetteh, Zhangyang Wang, Ufuk Topcu2026-06-05
💻 computer science

MoDex: A Diffusion Policy for Sequential Multi-Object Dexterous Grasping

मोडेक्स (MoDex) एक दो-चरणीय डिफ्यूजन पॉलिसी है जो एक कुशल हाथ (dexterous hand) को भविष्य के कार्यों के लिए डिग्री ऑफ फ्रीडम सुरक्षित रखने के लिए एक अपोजिशन स्पेस कंडीशन का उपयोग करके, पहले से पकड़ी गई वस्तुओं को छोड़े बिना क्रमिक रूप से कई वस्तुओं को पकड़ने में सक्षम बनाती है, जिससे मौजूदा बेसलाइन की तुलना में सिमुलेशन और वास्तविक दुनिया दोनों प्रयोगों में बेहतर सफलता दर प्राप्त होती है।

Haofei Lu, Hongjia Liu, Yifei Dong, Florian T. Pokorny, Jens Lundell, Danica Kragic2026-06-05
💻 computer science

Uncertainty-Aware Adaptive Sensor Fusion for Autonomous Navigation

यह शोध पत्र एक हाइब्रिड डीप लर्निंग फ्रेमवर्क प्रस्तावित करता है जो चुनौतीपूर्ण परिस्थितियों में स्वायत्त नेविगेशन के लिए सुदृढ़, उच्च-गति और सटीक विजुअल-इनर्शियल ओडोमेट्री प्राप्त करने हेतु एक विजन ट्रांसफार्मर और मल्टीस्केल सीएनएन को एक एडेप्टिव अनसेंटेड कालमन फिल्टर और अनसर्टेन्टी-अवेयर लॉस फंक्शन के साथ एकीकृत करता है।

Simegnew Yihunie Alaba, Yuichi Motai2026-06-05
💻 computer science

Learning Contact Representation for Leg Odometry

यह शोध पत्र एक स्व-पर्यवेक्षित (self-supervised) प्रतिनिधित्व शिक्षण ढांचे का प्रस्ताव करता है जो ओडोमेट्री अनुमान के लिए पैर के संपर्क चरणों को सटीक रूप से पहचानने हेतु मानक संयुक्त एनकोडर डेटा का उपयोग करता है, जो बिना किसी अतिरिक्त हार्डवेयर या मैन्युअल लेबलिंग के, बल सेंसर (force sensors) की आवश्यकता वाले पर्यवेक्षित तरीकों और आधारभूत संभाव्यता दृष्टिकोणों दोनों से बेहतर प्रदर्शन करता है।

Emre Girgin, Cagri Kilic2026-06-05
🤖 AI

What Objects Enable, Not What They Are: Functional Latent Spaces for Affordance Reasoning

यह शोधपत्र A4D को प्रस्तुत करता है, जो एक नवीन दृष्टिकोण है जो रोबोट नियोजन (प्लानिंग) को उपस्थिति-आधारित तर्क से कार्यात्मक सामर्थ्य (अफोर्डेंस) तर्क की ओर स्थानांतरित करता है, जो दृश्य प्रेक्षणों को वस्तुओं की क्षमताओं के इर्द-गिर्द व्यवस्थित एक साझा लेटेंट स्पेस में मैप करके किया जाता है, जिससे नवीन अंतःक्रियाओं के लिए सामान्यीकरण में महत्वपूर्ण सुधार होता है और अनदेखी सामर्थ्यों की तीव्र खोज सक्षम होती है।

Rohan Siva, Neel P. Bhatt, Yunhao Yang, Seoyoung Lee, Nishant Gadde, Christian Ellis, Alvaro Velasquez, Zhangyang Wang (…)2026-06-05
💻 computer science

Auditing Demonstration Curation Metrics: Action-Only Scorers Fail on the Structural Defects That Degrade Imitation Policies

यह शोध पत्र प्रदर्शन क्यूरेशन मेट्रिक्स (demonstration curation metrics) के ऑडिट के लिए एक नियंत्रित टेस्टबेड प्रस्तुत करता है और यह प्रकट करता है कि जबकि केवल क्रिया-आधारित स्कोरर (action-only scorers) उन संरचनात्मक त्रुटियों का पता लगाने में विफल रहते हैं जो इमिटेशन पॉलिसीज़ (imitation policies) को खराब करती हैं, अवस्था प्रक्षेपवक्र (state trajectories) का विश्लेषण करने वाले मेट्रिक्स ऐसे दोषों की पहचान करने के लिए आवश्यक हैं, हालांकि सर्वोत्तम विधियाँ भी डाउनस्ट्रीम प्रदर्शन को केवल आंशिक रूप से ही पुनः प्राप्त कर पाती हैं।

Aarav Bedi (University of California, Berkeley)2026-06-05
💻 computer science

Discrete-WAM: Unified Discrete Vision-Action Token Editing for World-Policy Learning

डिस्क्रीट-WAM एक एकीकृत डिस्क्रीट लेटेंट फ्रेमवर्क पेश करता है जो विजन और एक्शन टोकन को संरेखित करता है ताकि एक साझा डिस्क्रीट डिफ्यूजन प्रोसेस के माध्यम से वर्ल्ड डायनेमिक्स और डिसीजन पॉलिसीज को संयुक्त रूप से मॉडल करके स्वायत्त ड्राइविंग के लिए कंपोजिशनल कॉज़ल रीजनिंग, कंट्रोलेबल जनरेशन और काउंटरफैक्चुअल प्लानिंग को सक्षम बनाया जा सके।

Ziyang Yao, Haochen Liu, Yuncheng Jiang, Zeyu Zhu, Zibin Guo, Jingru Wang, Tianle Liu, Jianwei Cui, Kuiyuan Yang, Hongwe (…)2026-06-05
⚡ electrical engineering

Accelerating and Scaling MPC-Guided Reinforcement Learning for Humanoid Locomotion and Manipulation

यह शोध पत्र MPC-RL प्रस्तुत करता है, जो एक सेंट्रॉइडल-डायनामिक्स MPC रिवॉर्ड फॉर्मूलेशन को πn\pi^nMPC के साथ जोड़कर ह्यूमनॉइड लोकोमोशन और मैनिपुलेशन प्रशिक्षण को त्वरित और स्केल करता है, जहाँ πn\pi^nMPC एक नवीन पैरेलल-इन-होराइजन GPU सॉल्वर है जो कंस्ट्रक्शन ओवरहेड को समाप्त करता है और कुशल, कंस्ट्रेंट-अवेयर सुदृढीकरण शिक्षण (रिनफोर्समेंट लर्निंग) को सक्षम बनाता है।

Junheng Li, Liang Wu, Sergio A. Esteban, Lizhi Yang, Ján Drgoňa, Aaron D. Ames2026-06-05
🤖 AI

Let It Be Simple: One-Step Action Generation for Vision-Language-Action Models

यह शोध पत्र यह प्रदर्शित करता है कि विजन-लैंग्वेज-एक्शन मॉडल्स के लिए मजबूत वन-स्टेप एक्शन जनरेशन को केवल ट्रेनिंग टाइम डिस्ट्रीब्यूशन को हाई-नॉइज़ स्टेट्स की ओर बायस करके प्राप्त किया जा सकता है, जो इमेज सिंथेसिस में आमतौर पर आवश्यक जटिल डिस्टिलेशन या ऑक्जिलरी ऑब्जेक्टिव्स की आवश्यकता को समाप्त करता है और मल्टी-स्टेप डिफ्यूजन पॉलिसी के प्रदर्शन के बराबर या उससे बेहतर प्रदर्शन करता है।

Yitong Chen, Shiduo Zhang, Jingjing Gong, Xipeng Qiu2026-06-05✓ Author reviewed ⓘ