🤖 AI

Mind the Phase: Effective Rank and Representation Health in Legged Locomotion

यह शोध पत्र प्रदर्शित करता है कि लेग्ड लोक मोशन (legged locomotion) पॉलिसियों के फेज-कंडीशन्ड प्रभावी रैंक (phase-conditioned effective rank) का विश्लेषण करने से रिप्रजेंटेशन हेल्थ (representation health) में आर्किटेक्चरल बायस (architectural biases) का पता चलता है, जिसका उपयोग जॉइंट जिटर (joint jitter) को महत्वपूर्ण रूप से कम करने और सिम-टू-रियल (sim-to-real) ट्रांसफर को बेहतर बनाने के लिए किया जा सकता है।

Felipe Tommaselli, Thiago H. Segreto, Juliano D. Negri, Ricardo V. Godoy, Marcelo Becker2026-09-09
🤖 AI

From LLM-Generated Specifications to Learned Quadruped Locomotion

यह शोध पत्र प्रदर्शित करता है कि बड़े भाषा मॉडल प्राकृतिक भाषा विवरणों से पैरामीट्रिक सिग्नल टेम्पोरल लॉजिक (PSTL) विनिर्देश उत्पन्न कर सकते हैं ताकि व्याख्या योग्य रिवॉर्ड फंक्शन को स्वचालित रूप से व्युत्पन्न किया जा सके, जिससे क्वाड्रुपेड रोबोट्स को 100% सफलता दर के साथ मजबूत, उच्च-गति लोकोमोशन प्राप्त करने में सक्षम बनाया जा सके जो हस्तनिर्मित और कोड-आधारित रिवॉर्ड विधियों से काफी बेहतर प्रदर्शन करते हैं।

Merve Atasever, Keyan Azbijari, Cagan Bakirci, Alfredo Reina Corona, Tolga Izdas, Richard Yang, Erdem Biyik, Jyotirmoy V (…)2026-09-09
💻 computer science

OpenWAM: An Open, Modular Exploration Towards Systematic World-Action Model Pretraining

यह शोध पत्र OpenWAM को प्रस्तुत करता है, जो एक खुला और मॉड्यूलर अनुसंधान स्टैक है जो मुख्य डिज़ाइन सिद्धांतों को प्राप्त करने के लिए नियंत्रित प्रयोगों के माध्यम से वर्ल्ड-एक्शन मॉडल प्रीट्रेनिंग की व्यवस्थित रूप से जांच करता है, जिसका समापन 6,400 घंटों के विविध एम्बोडीड डेटा पर प्रशिक्षित उच्च-प्रदर्शन वाले OpenWAM-α\alpha मॉडल की रिलीज़ के साथ होता है।

Yuran Wang, Siqiao Huang, Mingleyang Li, Chenhao Zhang, Jiaqi Liang, Weiyang Jin, Yue Chen, Xuemin Chi, Donghao Zhou, Qi (…)2026-09-09
💻 computer science

Measuring Language Transfer in Robot Policies: Adding Greek to a Cosmos3 Vision-Language-Action Policy

यह शोध पत्र केवल मशीन-पुनर्गठित निर्देशों का उपयोग करके एक रोबोट विजन-लैंग्वेज-एक्शन पॉलिसी में ग्रीक भाषा को जोड़ने की जांच करता है, जो यह प्रकट करता है कि गलत निष्कर्षों से बचने के लिए मजबूत मूल्यांकन हेतु शून्य बेंचमार्क और सीड रेप्लिकेशन (seed replication) की आवश्यकता होती है, जबकि यह भी प्रदर्शित करता है कि द्विभाषी प्रशिक्षण विशिष्ट वाक्यांशों पर ओवरफिटिंग के बावजूद कंट्रोल्स की तुलना में निरंतर सुधार प्रदान करता है।

Ayoub Kirouane, Georgios Giaples, Christos Petrocheilos2026-09-09
💻 computer science

Generation of Vectorized Maps Beyond Vehicle View

यह शोध पत्र स्वायत्त वाहनों की सीमित संवेदन सीमा (sensing range) को दूर करने के लिए 'बियॉन्ड-व्यू वेक्टराइज्ड मैप जनरेशन' की नवीन समस्या को प्रस्तुत करता है, और सुरक्षित नेविगेशन के लिए लर्निंग-आधारित मैप फोरकास्टिंग की व्यवहार्यता प्रदर्शित करने हेतु पहला समाधान, 'बियॉन्डफॉर्मर' (BeyondFormer), एक समर्पित डेटासेट के साथ प्रस्तावित करता है।

Clara Gomez, Alberto Jaenal, Antonio Artuñedo, Jorge Godoy, Jorge Villagra2026-09-09
💻 computer science

ICI-VLA: In-Context Imitation with Spatiotemporally Aligned Demonstrations for Vision-Language-Action Models

ICI-VLA एक प्रशिक्षण और पुनर्प्राप्ति ढांचा है जो फिक्स्ड विजन-लैंग्वेज-एक्शन मॉडल्स को स्थानिक-काल्पनिक रूप से संरेखित, सिमेंटिक रूप से लेबल किए गए माइक्रो-डेमोन्स्ट्रेशन पर एक्शन जनरेशन को कंडिशन करके तीव्र, फ्यू-शॉट टेस्ट-टाइम एडाप्टेशन प्राप्त करने में सक्षम बनाता है, जिससे अतिरिक्त ग्रेडिएंट अपडेट की आवश्यकता समाप्त हो जाती है और कई रोबोटिक मैनिपुलेशन बेंचमार्क पर बेसलाइन्स से काफी बेहतर प्रदर्शन होता है।

Songhua Yang (Wuhan University), Ziyu Liu (Wuhan University), Xuetao Li (Wuhan University), Ruqi Xiao (Wuhan University) (…)2026-09-09
💻 computer science

Dex-X: Learning Visual-Tactile Dexterous Manipulation From Human Videos with Simulated Interaction

DEX-X एक ऐसा फ्रेमवर्क है जो मोनोकुलर मानव वीडियो से भौतिक रूप से आधारित हैंड-ऑब्जेक्ट इंटरैक्शन को पुनर्गठित करने के लिए टैक्टाइल कंप्लीशन इंजन के रूप में सिमुलेशन का लाभ उठाता है, जिससे बिना रोबोट-साइड डेटा संग्रह के विजुअल-टैक्टाइल डेक्सट्रस मैनिपुलेशन पॉलिसियों के प्रशिक्षण और ज़ीरो-शॉट रियल-वर्ल्ड परिनियोजन को सक्षम बनाया जा सके।

Ruoqu Chen, Feixiang Ruan, Liu Cao, Zihao Wang, Botian Xu, Shiqin Tong, Jiajun Liu, Mingzhi Pei, Chenyu Zhang, Wanli Xin (…)2026-09-09
💻 computer science

M3-Tele: A Unified Multimodal Teleoperational Framework for Compliant Whole-Body Mobile Manipulation

यह शोध पत्र M3-Tele को प्रस्तुत करता है, जो एक एकीकृत मल्टीमॉडल टेलीऑपरेशनल फ्रेमवर्क है जो विजुअल, टैक्टाइल, फोर्स और प्रोप्रियोसेप्टिव सेंसिंग को एकीकृत करता है ताकि कंप्लायंट होल-बॉडी मोबाइल मैनिपुलेशन को सक्षम बनाया जा सके, जो कॉन्टैक्ट-रिच टास्क परफॉरमेंस में महत्वपूर्ण सुधार करता है और डाउनस्ट्रीम पॉलिसी लर्निंग के लिए जॉइंट टैक्टाइल-फोर्स सेंसिंग के मूल्य को प्रदर्शित करता है।

Hengxiang Chen, Shenwen Deng, Yujian Ma, Gan Ma, Qiang Li, Nutan Chen2026-09-09
💻 computer science

Conditional Timed Partial Orders: An Expressive and Interpretable Framework for Robot Task Specification and Planning

यह शोधपत्र कंडीशनल टाइमड पार्शियल ऑर्डर्स (cTPOs) को प्रस्तुत करता है, जो रोबोट टास्क स्पेसिफिकेशन के लिए एक अभिव्यंजक ढांचा है जो समृद्ध टाइमिंग और कंडीशनल बाधाओं के साथ पारंपरिक TPOs का विस्तार करता है, और एक पूर्ण डिकंपोजिशन एल्गोरिदम प्रस्तावित करता है ताकि जटिल प्लानिंग समस्याओं को छोटे, व्याख्या योग्य उप-समस्याओं में तोड़कर उन्हें कुशलतापूर्वक हल किया जा सके, जिससे महत्वपूर्ण कम्प्यूटेशनल गति प्राप्त होती है।

Sebastian Escobar, Morteza Lahijanian2026-09-09
💻 computer science

mjorbit: A Simulation Framework for Space Robotics

यह शोध पत्र mjorbit को प्रस्तुत करता है, जो MuJoCo पर निर्मित एक उच्च-प्रदर्शन, ओपन-सोर्स सिमुलेशन फ्रेमवर्क है जो CPU और GPU बैकएंड दोनों के माध्यम से कुशल ऑन-ऑर्बिट सर्विसिंग, असेंबली और मैन्युफैक्चरिंग अनुसंधान को सक्षम करने के लिए मल्टी-बॉडी रोबोटिक्स डायनेमिक्स के साथ ऑर्बिट प्रोपेगेशन को एकीकृत करता है।

John Z. Zhang, Joris Verhagen, Fausto Vega, Patrick McKeen, Zachary Manchester2026-09-09