💻 computer science

Docking and Persistent Operations for a Resident Underwater Vehicle

यह शोध पत्र 90 मीटर की गहराई पर एक निवासी (रेसिडेंट) अंतर्जलीय निगरानी प्रणाली के विकास और सफल तैनाती को प्रस्तुत करता है, जिसमें एक स्वायत्त मिनी-आरओवी (mini-ROV) शामिल है जो USBL ध्वनिक नेविगेशन को ArUco मार्कर-आधारित दृश्य स्थानीयकरण के साथ एकीकृत करके 90% डॉकिंग सफलता दर और तीव्र निरीक्षण क्षमताएं प्राप्त करता है।

Leonard Günzel, Gabrielė Kasparavičiūtė, Ambjørn Grimsrud Waldum, Bjørn-Magnus Moslått, Abubakar Aliyu Badawi, Celil Yıl (…)2026-05-11
🤖 AI

Randomness is sometimes necessary for coordination

यह शोध पत्र डायमंड अटेंशन (Diamond Attention) का प्रस्ताव करता है, जो एक क्रॉस-अटेंशन आर्किटेक्चर है जो सैम्पल्ड रैंडम नंबरों का लाभ उठाकर क्षणिक रैंक ऑर्डरिंग (transient rank ordering) उत्पन्न करता है और समरूप एजेंटों के बीच समरूपता को तोड़ता है, जिससे उन सहकारी मल्टी-एजेंट सुदृढीकरण शिक्षण (cooperative multi-agent reinforcement learning) कार्यों में प्रभावी समन्वय और ज़ीरो-शॉट सामान्यीकरण सक्षम होता है जहाँ नियतात्मक नीतियां विफल हो जाती हैं।

Rohan Patil, Jai Malegaonkar, Henrik I. Christensen2026-05-11
⚡ electrical engineering

CARMEN: CORDIC-Accelerated Resource-Efficient Multi-Precision Inference Engine for Deep Learning

यह शोध पत्र CARMEN को प्रस्तुत करता है, जो एक संसाधन-कुशल डीप लर्निंग इन्फरेंस इंजन है जो कम्प्यूटेशनल परिशुद्धता (computational precision) को गतिशील रूप से समायोजित करने के लिए एक रनटाइम-एडेप्टिव CORDIC-आधारित आर्किटेक्चर का लाभ उठाता है, जिससे ASIC और FPGA दोनों प्लेटफॉर्म पर उच्च प्रदर्शन प्रदान करते हुए पावर और साइकिल काउंट में महत्वपूर्ण कमी आती है।

Sonu Kumar, Mukul Lokhande, Santosh Kumar Vishvakarma, Adam Teman2026-05-11
🤖 AI

Learning Visual Feature-Based World Models via Residual Latent Action

यह शोध पत्र RLA वर्ल्ड मॉडल को प्रस्तुत करता है, जो कुशल, उच्च-निष्ठा वाले विज़ुअल फीचर प्रेडिक्शन प्राप्त करने और बिना ऑनलाइन इंटरेक्शन या हस्तनिर्मित रिवार्ड्स के ऑफलाइन वीडियो से उन्नत रोबोट लर्निंग को सक्षम करने के लिए DINO रेसिडुअल्स से सीखे गए और फ्लो मैचिंग के माध्यम से प्रेडिक्ट किए गए एक नवीन रेसिडुअल लेटेंट एक्शन रिप्रेजेंटेशन का लाभ उठाता है।

Xinyu Zhang, Zhengtong Xu, Yutian Tao, Yeping Wang, Yu She, Abdeslam Boularias2026-05-11
🤖 AI

Escaping the Diversity Trap in Robotic Manipulation via Anchor-Centric Adaptation

यह शोध पत्र सख्त डेटा बजट के तहत विजन-लैंग्वेज-एक्शन मॉडल्स को अनुकूलित करने में एक "विविधता जाल" (diversity trap) की पहचान करता है, एक "कवरेज-डेंसिटी ट्रेड-ऑफ" (Coverage-Density Trade-off) ढांचे का प्रस्ताव करता है, और एंकर-सेंट्रिक अडैप्टेशन (ACA) पेश करता है—जो एक दो-चरणीय विधि है जो सीमाओं तक विस्तार करने से पहले मुख्य एंकर्स पर बार-बार होने वाले प्रदर्शनों को प्राथमिकता देती है—ताकि मानक विविध सैंपलिंग रणनीतियों की तुलना में रोबोटिक कार्य विश्वसनीयता में उल्लेखनीय सुधार किया जा सके।

Yanzhe Chen, Kevin Yuchen Ma, Qi Lv, Yiqi Lin, Zechen Bai, Chen Gao, Mike Zheng Shou2026-05-11
🤖 AI

Operating Within the Operational Design Domain: Zero-Shot Perception with Vision-Language Models

यह शोध पत्र ODD वर्गीकरण और पहचान पर एक अनुभवजन्य अध्ययन आयोजित करके, अनुकूलन रणनीतियों का विश्लेषण करके, और परिभाषा-आधारित चेन-ऑफ-थॉट प्रॉम्प्टिंग को व्यक्तित्व अपघटन (persona decomposition) के साथ सुरक्षा-महत्वपूर्ण अनुप्रयोगों में सुरक्षित, अनुकूलनीय धारणा के लिए सबसे प्रभावी दृष्टिकोण के रूप में पहचान कर, स्वायत्त प्रणालियों के लिए ज़ीरो-शॉट "ODD सेंसर" के रूप में विज़न-लैंग्वेज मॉडल्स की प्रभावशीलता का मूल्यांकन करता है।

Berkehan Ünal, Dierend Hauke, Fazlija Dren, Plachetka Christopher2026-05-11
🤖 machine learning

Drifting Field Policy: A One-Step Generative Policy via Wasserstein Gradient Flow

यह शोध पत्र ड्रिफ्टिंग फील्ड पॉलिसी (DFP) का प्रस्ताव करता है, जो एक नॉन-ODE वन-स्टेप जनरेटिव पॉलिसी है जो रोबोटिक मैनिपुलेशन कार्यों पर स्टेट-ऑफ-द-आर्ट प्रदर्शन प्राप्त करने के लिए एक्शन-वैल्यू एसेंट (action-value ascent) को स्कोर-मैचिंग ट्रस्ट रीजन्स (score-matching trust regions) के साथ संयोजित करते हुए अपडेट्स को रिवर्स-KL वासेरस्टीन-2 ग्रेडिएंट फ्लो (reverse-KL Wasserstein-2 gradient flows) के रूप में फ्रेम करता है।

Juil Koo, Mingue Park, Jiwon Choi, Yunhong Min, Minhyuk Sung2026-05-11
🤖 AI

Text-to-CAD Evaluation with CADTests

यह शोध पत्र CADTestBench प्रस्तुत करता है, जो Text-to-CAD के लिए पहला टेस्ट-आधारित बेंचमार्क है जो CAD मॉडल के निर्माण का कठोरता से मूल्यांकन करने और उसे निर्देशित करने के लिए निष्पादन योग्य सॉफ्टवेयर परीक्षणों (executable software tests) का उपयोग करता है, और यह प्रदर्शित करता है कि यह दृष्टिकोण मौजूदा पद्धतियों के प्रदर्शन को पीछे छोड़ सकता है।

Dimitrios Mallis, Marco Wang, Ahmet Serdar Karadeniz, Elisa Ricci, Anis Kacem, Djamila Aouada2026-05-11
🤖 AI

TAVIS: A Benchmark for Egocentric Active Vision and Anticipatory Gaze in Imitation Learning

यह शोधपत्र TAVIS प्रस्तुत करता है, जो विविध कार्य सूट्स, एम्बॉडीड प्लेटफॉर्म और 'गेज़-एक्शन लीड टाइम' जैसे नवीन मेट्रिक्स वाले एक व्यापक बेंचमार्क और मूल्यांकन इंफ्रास्ट्रक्चर के रूप में एक्टिव-विज़न इमिटेशन लर्निंग को दर्शाता है, ताकि रोबोटिक मैनिपुलेशन में पूर्वभासी दृष्टि (anticipatory gaze) के लाभों और सीमाओं को व्यवस्थित रूप से मापा जा सके।

Giacomo Spigler2026-05-11
🤖 machine learning

Leveraging Analytic Gradients in Provably Safe Reinforcement Learning

यह शोधपत्र एनालिटिक ग्रेडिएंट-आधारित सुदृढीकरण शिक्षण (reinforcement learning) के लिए पहले प्रभावी सुरक्षात्मक ढांचे (safeguarding framework) को प्रस्तुत करता है, जो यह प्रदर्शित करता है कि प्रशिक्षण के दौरान विभेदक सुरक्षा तंत्रों (differentiable safety mechanisms) को एकीकृत करना सीखने के प्रदर्शन से समझौता किए बिना नियंत्रण कार्यों में प्रमाणित सुरक्षा सुनिश्चित करता है।

Tim Walter, Hannah Markgraf, Jonathan Külz, Matthias Althoff2026-05-08