🤖 machine learning

What Demonstration Curation Metrics Do to Your Policy

यह शोध पत्र प्रकट करता है कि दोषों का पता लगाने (defect detection) के लिए अनुकूलित प्रदर्शन-क्यूरेशन मेट्रिक्स अक्सर एपिसोड की लंबाई जैसे भ्रमित करने वाले कारकों के कारण डाउनस्ट्रीम पॉलिसी प्रदर्शन को सुधारने में विफल रहते हैं, और यह तर्क देता है कि क्यूरेशन विधियों का मूल्यांकन उनकी दोष-फ्लैगिंग सटीकता के बजाय परिणामी पॉलिसी की गुणवत्ता द्वारा किया जाना चाहिए।

Aarav Bedi2026-06-10
🤖 AI

What Matters in Orchestrating Robot Policies: A Systematic Study of Hierarchical VLA Agents

यह शोध पत्र रोबोटिक हेरफेर (manipulation) के लिए पदानुक्रमित विजन-लैंग्वेज-एक्शन (Hi-VLA) एजेंटों का एक व्यवस्थित अध्ययन प्रस्तुत करता है, जो मौजूदा डिज़ाइनों को एक नियंत्रण ढांचे के तहत एकीकृत करता है ताकि उन व्यावहारिक सिद्धांतों को निकाला जा सके जो विविध कार्यों में फ्लैट या सहज रूप से डिज़ाइन किए गए पदानुक्रमों की तुलना में काफी अधिक मजबूत और सुदृढ़ प्रणाली प्रदान करते हैं।

Jiaheng Hu, Mohit Shridhar, Caden Lu, Dhruv Shah, Hao-Tien Lewis Chiang, Jie Tan, Annie Xie2026-06-10
💻 computer science

Locomotion analysis of a quadruped interacting with the lunar granular surface

यह शोध पत्र कठोर बनाम मृदु संपर्क सिमुलेशन में सुदृढीकरण लर्निंग (Reinforcement Learning) द्वारा प्रशिक्षित नीतियों की तुलना करके क्वाड्रुपेड रोबोट के संचलन पर चंद्र दानेदार रेगोलिथ के प्रभाव की जांच करता है, जिससे यह स्पष्ट होता है कि मृदु मृदा अंतःक्रियाओं के लिए गुणात्मक रूप से भिन्न चालों की आवश्यकता होती है और ऊर्जा व्यय में उल्लेखनीय वृद्धि होती है।

Yash J Vyas2026-06-10
🤖 AI

Hierarchical Policies from Verbal and Egocentric Human Signals for Natural Human-Robot Interaction

यह शोध पत्र EDITH को प्रस्तुत करता है, जो एक पदानुक्रमित रोबोट फ्रेमवर्क है जो स्मार्ट ग्लासेस से प्राप्त वास्तविक समय के प्रथम-व्यक्ति दृश्य (first-person view), दृष्टि (gaze) और वाक् (speech) डेटा का लाभ उठाता है ताकि मौखिक और गैर-मौखिक मानवीय संकेतों की व्याख्या की जा सके, जिससे उपयोगकर्ताओं पर संचार के बोझ को कम करके अधिक स्वाभाविक और कुशल मानव-रोबोट संपर्क सक्षम किया जा सके।

Dongjun Lee, Juheon Choi, Dong Kyu Shin, Sinjae Kang, Kimin Lee2026-06-10
🔢 mathematics

Improved Representation of Matrix Lie Group Operations through Tensor Notation

यह शोध पत्र मैट्रिक्स ली समूहों (matrix Lie groups) के लिए टेंसर और आइंस्टीन योग संकेतन (Einstein summation notation) के एक नवीन अनुप्रयोग को प्रस्तुत करता है, जो ग्रेडिएंट-आधारित अनुमान समस्याओं में अवकलजों (derivatives) और संक्रियाओं की गणना के लिए एक अधिक स्पष्ट और सुबोध गणितीय ढांचा प्रदान करता है।

Clark Taylor2026-06-10
💻 computer science

SARM2: Multi-Task Stage Aware Reward Modeling for Self Improving Robotic Manipulation

यह शोध पत्र SARM2 प्रस्तुत करता है, जो एक मल्टी-टास्क स्टेज-अवेयर रिवॉर्ड मॉडल है जिसे SPIRAL फ्रेमवर्क के साथ संयोजित किया गया है, जो स्वायत्त रोलआउट्स से सघन, सटीक रिवॉर्ड्स उत्पन्न करके लॉन्ग-होराइजन कार्यों पर VLA पॉलिसी के प्रदर्शन को महत्वपूर्ण रूप से बढ़ाने के लिए स्व-सुधारित रोबोटिक मैनिपुलेशन को सक्षम बनाता है।

Qianzhong Chen, Hau Zheng, Justin Yu, Suning Huang, Jiankai Sun, Ken Goldberg, Chuan Wen, Pieter Abbeel, Yide Shentu, Ph (…)2026-06-10
💻 computer science

OMG: Omni-Modal Motion Generation for Generalist Humanoid Control

यह शोध पत्र OMG प्रस्तुत करता है, जो एक स्केलेबल, डिफ्यूजन-आधारित फ्रेमवर्क है जो सामान्यज्ञ ह्यूमनॉइड नियंत्रण के लिए एक पदानुक्रमित वास्तुकला को एक सूक्ष्मता से क्यूरेट किए गए डेटासेट के साथ जोड़ता है ताकि भाषा, ऑडियो और संदर्भ गतियों द्वारा अनुकूलित अवस्था-सर्वव्यापी (ओम्नी-मोडल) पूर्ण-शरीर गति उत्पादन को सक्षम बनाया जा सके।

Siqiao Huang, Kun-Ying Lee, Dongming Qiao, Guanqi He, Zhenyu Wang, Yitang Li, Shaoting Zhu, Hang Zhao2026-06-10
🤖 AI

Test-time Adversarial Takeover: A Real-time Hijacking Interface against Robotic Diffusion Policies

यह शोध पत्र टेस्ट-टाइम एडवर्सरियल टेकओवर (TAKO) को प्रस्तुत करता है, जो एक नवीन हमला है जो कैमरा स्ट्रीम में एक सीखे हुए यूनिवर्सल विजुअल पैचेस के वोकैबुलरी को इंजेक्ट करके फ्रोजन रोबोटिक डिफ्यूजन पॉलिसीज़ को हाईजैक करता है, जिससे मानव ऑपरेटरों को विविध कार्यों और आर्किटेक्चर में मनचाहे उद्देश्यों की ओर रोबोट को रिमोटली स्टीयर करने में 100% सफलता प्राप्त करने में सक्षम बनाता है।

Zi Yin, Peilin Chai, Siyuan Huang, Zhanhao Hu2026-06-10
💻 computer science

UMI-Bench 1.0: An Open and Reproducible Real-World Benchmark for Tabletop Robotic Manipulation with UMI Data

यह शोधपत्र UMI-Bench 1.0 प्रस्तुत करता है, जो कि पहला खुला और पुनरुत्पादक वास्तविक दुनिया का बेंचमार्क है जिसे डेटा संग्रह, दृश्य रीसेट, निष्पादन और विश्लेषण को एक एकल ऑडिट योग्य प्रोटोकॉल के भीतर एकीकृत करके यूनिवर्सल मैनिपुलेशन इंटरफेस (UMI)-शैली की नीतियों के मूल्यांकन को मानकीकृत करने के लिए डिज़ाइन किया गया है।

Shi Jin, Yuntian Wang, Yuhui Duan, Di Wu, Gaoqi Dong, Xiaohang Liu, Xiaotong Li, Hongfei Jia, Zehao Zhang, Tianyu Wang (…)2026-06-10
💻 computer science

Uncovering Vulnerability of Vision-Language-Action Models under Joint-Level Physical Faults

यह शोध पत्र प्रदर्शित करता है कि विजन-लैंग्वेज-एक्शन मॉडल उन जॉइंट-लेवल भौतिक दोषों के प्रति संवेदनशील हैं जो एक्शन-टू-मोशन इंटरफ़ेस को बाधित करते हैं और J-PARC का प्रस्ताव करता है, जो एक हल्का रेसिडुअल कैलिब्रेशन फ्रेमवर्क है जो एक्शन को अनुकूल रूप से सुधारने और दोष-मुक्त प्रदर्शन से समझौता किए बिना मजबूती बहाल करने के लिए जॉइंट डायनेमिक्स से लेटेंट फॉल्ट रिजीम्स का अनुमान लगाता है।

Minsoo Jo, Taeju Kwon, Junha Chun, Youngjoon Jeong, Taesup Kim2026-06-10