💻 computer science

Designing for Robot Wranglers: A Synthesis of Literature and Practice

यह शोध पत्र एक स्कोपिंग समीक्षा और चिंतनशील विश्लेषण के माध्यम से उभरती हुई "रोबोट रैंगलर" (robot wrangler) की भूमिका को प्रस्तुत करता है ताकि उन डिजाइन निहितार्थों को संश्लेषित किया जा सके जो जटिल मानव-रोबोट सेवा पारिस्थितिकी तंत्र के भीतर रोबोटों के प्रबंधन में इन व्यक्तियों को बेहतर सहायता प्रदान कर सकें।

David Porfirio, Ian McDermott, Hsin-Mei Chen, Satoru Satake, Takayuki Kanda, Thomas D. LaToza2026-05-18
⚡ electrical engineering

Dynamic Plasma Shape Control with Arbitrary Sensor Subsets

यह शोध पत्र एक उच्च-सटीकता वाले सिमुलेशन में प्रशिक्षित एक सुदृढीकरण शिक्षण (reinforcement learning) एजेंट प्रस्तुत करता है जो बिना किसी बैकअप नियंत्रक या मोड-स्विचिंग लॉजिक की आवश्यकता के, यादृच्छिक डायग्नोस्टिक सेंसर विफलताओं को सहन करते हुए और साथ ही मनमाने लक्ष्यों को ट्रैक करते हुए, टोकामक में सुदृढ़, ज़ीरो-शॉट गतिशील प्लाज्मा आकार नियंत्रण प्राप्त करता है।

D. Sorokin, M. Stokolesov, A. Granovskiy, I. Prokofyev, E. Adishchev, M. Nurgaliev, E. Khayrutdinov, G. Subbotin, R. Cla (…)2026-05-18
💻 computer science

A Reproducible and Physically Feasible Dynamic Parameter Identification Framework for a Low-Cost Robot Arm

यह शोध पत्र एक रिड्यूस्ड-ऑर्डर मॉडल, स्ट्रक्चर्ड एक्साइटेशन ट्रेजेक्टरीज, और सांख्यिकीय सुसंगतता एवं जड़त्व मैट्रिक्स (इनेर्शिया मैट्रिक्स) की वैधता सुनिश्चित करने के लिए ओएलएस (OLS), एसडीपी (SDP) प्रोजेक्शन, और सीएलआईई (CLIE) रिफाइनमेंट के मल्टी-स्टेज पाइपलाइन को संयोजित करके कम लागत वाले CRANE-X7 रोबोट आर्म के भौतिक रूप से व्यवहार्य गतिशील मापदंडों की पहचान करने के लिए एक पुनरुत्पादक ढांचा प्रस्तुत करता है।

Junji Oaki, Koki Yamane, Koki Inami, Sho Sakaino2026-05-18
💻 computer science

WorldVLN: Autoregressive World Action Model for Aerial Vision-Language Navigation

WorldVLN हवाई विजन-लैंग्वेज नेविगेशन के लिए पहला ऑटोरेग्रेसिव वर्ल्ड एक्शन मॉडल पेश करता है जो सीधे निष्पादन योग्य वेपॉइंट कार्यों को डिकोड करने के लिए शॉर्ट-होरिज़न वर्ल्ड-स्टेट ट्रांज़िशन की भविष्यवाणी करता है, जो बेंचमार्क पर बेहतर प्रदर्शन और ज़ीरो-शॉट रियल-वर्ल्ड ड्रोन परिनियोजन प्राप्त करने के लिए एक्शन-अवेयर GRPO के साथ एक नवीन टू-स्टेज ट्रेनिंग फ्रेमवर्क का उपयोग करता है।

Baining Zhao, Jiacheng Xu, Weicheng Feng, Xin Zhang, Zhaolu Wang, Haoyang Wang, Shilong Ji, Ziyou Wang, Jianjie Fang, Zh (…)2026-05-18
🤖 AI

Learning Bilevel Policies over Symbolic World Models for Long-Horizon Planning

यह शोधपत्र BISON को प्रस्तुत करता है, जो एक ऐसा सिस्टम है जो लंबी अवधि की योजना बनाने वाले कार्यों (long-horizon planning tasks) को बड़ी संख्या में वस्तुओं के साथ कुशलतापूर्वक हल करने में सक्षम बाईलवल पॉलिसियों (bilevel policies) को बनाने के लिए लो-लेवल न्यूरल इमिटेशन लर्निंग को हाई-लेवल सिम्बोलिक एब्स्ट्रैक्शंस के साथ जोड़ता है, जो स्केलेबिलिटी और दक्षता में मौजूदा एंड-टू-एंड विधियों से बेहतर प्रदर्शन करता है।

Dillon Z. Chen, Till Hofmann, Toryn Q. Klassen, Sheila A. McIlraith2026-05-18
🤖 machine learning

Adaptive Outer-Loop Control of Quadrotors via Reinforcement Learning

यह शोध पत्र क्वाड्रोटर्स के लिए एक एडेप्टिव आउटर-लूप कंट्रोल आर्किटेक्चर प्रस्तावित करता है जो अत्यधिक रूढ़िवादी डोमेन रैंडमाइजेशन पर निर्भर हुए बिना, गंभीर डायनेमिक डिस्टर्बेंस और मॉडल अनसर्टेन्टी के तहत मजबूत, उच्च-परिशुद्धता ट्रैजेक्टरी ट्रैकिंग प्राप्त करने के लिए एक डीप रिइन्फोर्समेंट लर्निंग पॉलिसी को रेजिडुअल डायनेमिक्स प्रेडिक्टर और ऑनलाइन कैलिब्रेशन मैकेनिज्म के साथ जोड़ता है।

Vishnu Saj, Sushi Vemuri, Dileep Kalathil, Moble Benedict2026-05-18
🤖 AI

Learning Sim-Grounded Policies for Bimanual Rope Manipulation from Human Teleoperation Data

यह शोध पत्र यह प्रदर्शित करता है कि द्विपक्षीय रस्सी हेरफेर (bimanual rope manipulation) कार्यों के लिए, भौतिकी-संगत 3D कण अवस्थाओं (physics-consistent 3D particle states) पर आधारित नीतियां, समान सीमित मानव टेलीऑपरेशन डेटा पर प्रशिक्षित विजन-आधारित नीतियों की तुलना में काफी बेहतर प्रदर्शन करती हैं, जो इस बात को रेखांकित करता है कि विजुअल दृष्टिकोणों में सामान्यीकरण (generalization) की कमी अवलोकन स्थान (observation space) के कारण है न कि नीति वास्तुकला (policy architecture) के कारण।

Gina Wigginghaus, Tim Missal, Berk Guler, Simon Manschitz, Jan Peters2026-05-18
💻 computer science

Beyond Collision Avoidance: Multi-Robot Yielding and Spatial Affordance in Emergency Evacuations

56 प्रतिभागियों के एक आभासी निकासी प्रयोग के माध्यम से, यह अध्ययन प्रदर्शित करता है कि सुरक्षित मल्टी-रोबोट आपातकालीन व्यवहार के लिए केवल टकराव से बचने से आगे बढ़कर अर्थपूर्ण रूप से जागरूक नेविगेशन की आवश्यकता है जो मानवीय स्थानिक अपेक्षाओं के साथ संरेखित होने और कथित संज्ञानात्मक विलंब को कम करने के लिए शरण स्थलों (refuge niches) जैसे पर्यावरणीय सामर्थ्य (affordances) का सक्रिय रूप से उपयोग करता है।

Ning Zhou, Edmund R. Hunt, Nikolai W. F. Bode2026-05-18
💻 computer science

STABLE: Simulation-Ready Tabletop Layout Generation via a Semantics-Physics Dual System

STABLE एक नवीन द्वैत-प्रणाली ढांचा है जो सिमेंटिक लेआउट जनरेशन के लिए एक फाइन-ट्यून्ड LLM को भौतिक सुधार के लिए एक फिजिक्स-अवेयर फ्लो-आधारित मॉडल के साथ जोड़ता है, जो कार्य निर्देशों का कड़ाई से पालन करते हुए और टकराव-मुक्त एवं भौतिक रूप से प्रशंसनीय वस्तु व्यवस्था सुनिश्चित करते हुए, सिमुलेशन-रेडी टेबलटॉप दृश्यों के क्रमिक निर्माण को सक्षम बनाता है।

Zhen Luo, Yixuan Yang, Xudong Xu, Jinkun Hao, Zhaoyang Lyu, Feng Zheng, Jiangmiao Pang, Yanwei Fu2026-05-18
🤖 machine learning

Learn Where Outcomes Diverge: Efficient VLA RL via Probabilistic Chunk Masking

यह शोध पत्र प्रोबबिलिस्टिक चंक मास्किंग (PCM) प्रस्तुत करता है, जो GRPO-आधारित विजन-लैंग्वेज-एक्शन (VLA) सुदृढीकरण शिक्षण (reinforcement learning) में एक गणनात्मक रूप से कुशल संशोधन है, जो बिना किसी अतिरिक्त रिवॉर्ड मॉडल या क्रिटिक्स की आवश्यकता के, केवल उन प्रक्षेपवक्र चंक्स (trajectory chunks) के माध्यम से ग्रेडिएंट्स को चुनिंदा रूप से बैकप्रोपैगेट करके प्रशिक्षण को महत्वपूर्ण रूप से तेज करता है और मेमोरी के उपयोग को कम करता है जहाँ सफल और विफल रोलआउट्स अलग होते हैं।

Vaidehi Bagaria, Nikshep Grampurohit, Pulkit Verma2026-05-18