💻 computer science

Tripody: An Overconstrained 3-SPR-like Parallel Robot for High-Reach Construction Tasks

यह शोध पत्र ट्रिपोडी (Tripody) का परिचय देता है, जो एक हल्का, ओवरकन्स्ट्रेंड (overconstrained) 3-SPR-समान पहिये वाला समानांतर रोबोट है, जो भारी-भार वाले सीलिंग निर्माण कार्यों के लिए उच्च टॉर्सनल स्टिफनेस (torsional stiffness) और मिलीमीटर-स्तर की पोजिशनिंग सटीकता प्राप्त करने के लिए इलास्टिक कंप्लायंस (elastic compliance) का उपयोग करता है।

Julien Kindle, Jakub Raczy, Riccardo Balbi, Andrea Alessandretti, Cesar Cadena, Marco Hutter2026-07-29
💻 computer science

Transformer Transformer: A Unified Model for Motion-Conditioned Robot Co-design

यह शोध पत्र "ट्रांसफॉर्मर ट्रांसफॉर्मर" (Transformer Transformer) पेश करता है, जो रोबोटो टोकन्स (RoboTokens) पर प्रशिक्षित एक एकीकृत डिफ्यूजन ट्रांसफॉर्मर मॉडल है जो एक नवीन डायनेमिक्स सेल्फ-गाइडेंस (Dynamics Self-Guidance) तंत्र के माध्यम से अनदेखे कार्यों और पुरस्कारों के लिए अनुकूलित रोबोटिक स्वरूपों (embodiments) और नियंत्रकों को उत्पन्न करके मोशन-कंडीशन्ड रोबोट को-डिज़ाइन को सक्षम बनाता है, जो इवोल्यूशनरी बेसलाइन्स की तुलना में महत्वपूर्ण प्रदर्शन सुधार प्राप्त करता है।

Huy Ha, C. Karen Liu, Shuran Song2026-07-29
💻 computer science

DC-WAM: Dynamic-Centric Visual Supervision and Reasoning for World-Action Models

DC-WAM एक डायनेमिक-सेंट्रिक फ्रेमवर्क है जो वर्ल्ड-एक्शन मॉडल्स को फोटोरियलिस्टिक अपीयरेंस से इंटरैक्शन-प्रेरित विजुअल डायनेमिक्स की ओर सुपरविजन को स्थानांतरित करके और एक टोकन-वाइज डायनेमिक रिलिवेंस प्रेडिक्टर का उपयोग करके बेहतर बनाता है, जिससे तैनाती के समय अतिरिक्त मोडैलिटीज की आवश्यकता के बिना रोबोट नियंत्रण प्रदर्शन और पर्यावरणीय व्यवधानों के प्रति मजबूती में सुधार होता है।

Haoyuan Ji, Lingxiang Fan, Shang Su, Yinqiao Lu, Mengkai Shi, Jun Gao, Shuo Feng2026-07-29
💻 computer science

S2A2: Audio-Visual Imitation Learning for Manipulation Tasks Using Acoustic Spatial Information

यह शोध पत्र S2A2 प्रस्तुत करता है, जो एक मल्टीमॉडल इमिटेशन लर्निंग फ्रेमवर्क है जो विजुअल फीचर्स को ध्वनिक स्थानिक और सिग्नल जानकारी के साथ एकीकृत करता है ताकि रोबोट्स को लक्ष्य के स्थानीयकरण और पहचान के लिए श्रव्य संकेतों का उपयोग करके हेरफेर कार्यों (manipulation tasks) को प्रभावी ढंग से करने में सक्षम बनाया जा सके।

Kaneyoshi Hiratsuka, Benjamin Yen, Ryosuke Kojima2026-07-29
🤖 machine learning

πR2\pi\mathbf{R}^2: Reactive Real-time Flow Policies

यह शोध पत्र πR2\pi\mathbf{R}^2 प्रस्तुत करता है, जो एक ऐसा ढांचा है जो तेज़ प्रोप्रियोसेप्टिव (proprioceptive) और धीमे विज़ुअल कंडीशनिंग को अलग करके और एक लेटेंसी-एडेप्टिव (latency-adaptive) फ्लो शेड्यूल का उपयोग करके जनरलइस्ट एक्शन-चंकिंग फ्लो पॉलिसियों को रीयल-टाइम रिएक्टिविटी के साथ उन्नत करता है, जिससे उच्च-आवृत्ति वाले क्लोज्ड-लूप नियंत्रण को सक्षम बनाया जा सके और बिना किसी नए बैकबोन आर्किटेक्चर की आवश्यकता के गतिशील हेरफेर कार्यों में सफलता दर में उल्लेखनीय सुधार किया जा सके।

Sungjae Park, Shubham Tulsiani2026-07-29
⚡ electrical engineering

Unifying Complementarity Constraints and Control Barrier Functions for Safe Whole-Body Robot Control

यह शोधपत्र सैंपल्ड-डेटा, फर्स्ट-ऑर्डर सिस्टम के लिए कॉम्प्लीमेंटैरिटी कंस्ट्रेंट्स (complementarity constraints) और कंट्रोल बैरियर फंक्शन्स (control barrier functions) के बीच एक औपचारिक तुल्यता स्थापित करता है, जिससे इन दोनों पद्धतियों को एकीकृत किया जा सके ताकि सुरक्षित होल-बॉडी रोबोट नियंत्रण में मजबूती की गारंटी और एल्गोरिदम संबंधी सुधारों का क्रॉस-एप्लीकेशन सक्षम हो सके।

Rafael I. Cabral Muchacho, Riddhiman Laha, Florian T. Pokorny, Luis F. C. Figueredo, Nilanjan Chakraborty2026-07-28
🤖 AI

CoopReflect: Towards Natural Language Communication for Cooperative Autonomous Driving via Multi-Agent Learning

यह शोध पत्र CoopReflect को प्रस्तुत करता है, जो एक मल्टी-एजेंट लर्निंग फ्रेमवर्क है जो स्वायत्त वाहनों (ऑटोनॉमस व्हीकल्स) को सुरक्षित और अधिक कुशल सहकारी ड्राइविंग के लिए प्राकृतिक भाषा के माध्यम से संवाद करने में सक्षम बनाता है, जो मानक LLM एजेंटों की समन्वय सीमाओं को दूर करने के लिए ट्रायल-एंड-एरर लर्निंग को मल्टी-एजेंट डिब्रीफिंग के साथ जोड़ता है।

Jiaxun Cui, Chen Tang, Jarrett Holtz, Janice Nguyen, Alessandro G. Allievi, Hang Qiu, Peter Stone2026-07-28
⚡ electrical engineering

ACCESS-AV: Adaptive Communication-Computation Codesign for Sustainable Autonomous Vehicle Localization in Smart Factories

यह शोध पत्र ACCESS-AV का प्रस्ताव करता है, जो एक अनुकूलित (adaptive) संचार-गणना ढांचा है जो स्मार्ट कारखानों में ऊर्जा-कुशल, 30 सेमी से कम की स्वायत्त वाहन स्थानीयकरण प्राप्त करने के लिए मौजूदा 5G सिंक्रोनाइज़ेशन सिग्नल ब्लॉक्स और एक अनुकूलित MUSIC एल्गोरिदम का लाभ उठाता है, जिसके परिणामस्वरूप गैर-अनुकूलित प्रणालियों की तुलना में ऊर्जा खपत में 43.09% की कमी आती है।

Rajat Bhattacharjya, Arnab Sarkar, Ish Kool, Sabur Baidya, Nikil Dutt2026-07-28
💻 computer science

Agentic Reward Modeling: Verifying GUI Agent via Progressive Trajectory-Grounded Interaction

यह शोधपत्र VAGEN को प्रस्तुत करता है, जो एक ऐसा ढांचा है जो मौजूदा निष्क्रिय और अत्यधिक-प्रोबिंग (over-probing) रिवॉर्ड मॉडलिंग विधियों की सीमाओं को दूर करने के लिए एक प्रोग्रेसिव, सरफेस-टू-लेटेंट (surface-to-latent) सत्यापन तंत्र के साथ टूल-ऑगमेंटेड वेरिफायर एजेंट का उपयोग करता है, जिससे OSWorld-Verified और AndroidWorld जैसे बेंचमार्क पर GUI एजेंट मूल्यांकन की सटीकता और दक्षता में महत्वपूर्ण सुधार होता है।

Chaoqun Cui, Jing Huang, Shijing Wang, Liming Zheng, Qingchao Kong, Zhixiong Zeng2026-07-28
💻 computer science

Imitation Learning for Robot Assistance in Open Surgery: A Multi-Policy Evaluation on Suture Following

यह अध्ययन ओपन सर्जरी में सर्जन-रोबोट सहयोगात्मक सहायता के लिए सामान्य-उद्देश्यीय इमिटेशन लर्निंग (imitation learning) का पहला मल्टी-पॉलिसी मूल्यांकन प्रस्तुत करता है, जो यह प्रदर्शित करता है कि π0\pi_0 पॉलिसी बेहतर सुदृढ़ता और 92% स्टिच पूर्णता दर प्राप्त करती है और साथ ही गहराई की धारणा (depth perception) एवं एंड-इफेक्टर डिज़ाइन को नैदानिक अनुवाद (clinical translation) के लिए महत्वपूर्ण प्राथमिकताओं के रूप में पहचानती है।

Xucheng Wang, Zhizhou Yang, Xiaoman Zhang, Sung Eun Kim, Romain Hardy, Pranav Rajpurkar2026-07-28