🤖 AI

Overcoming Environmental Meta-Stationarity in MARL via Adaptive Curriculum and Counterfactual Group Advantage

यह शोधपत्र CL-MARL को प्रस्तुत करता है, जो एक अनुकूलनशील पाठ्यक्रम शेड्यूलर (FlexDiff) को काउंटरफैक्चुअल ग्रुप एडवांटेज एल्गोरिदम (CGRPA) के साथ जोड़कर मल्टी-एजेंट सुदृढीकरण शिक्षण में स्थिर-कठिनाई प्रशिक्षण की सीमाओं को दूर करता है ताकि चुनौतीपूर्ण सहकारी कार्यों पर बेहतर प्रदर्शन और तेज़ अभिसरण प्राप्त किया जा सके।

Weiqiang Jin, Yang Liu, Shixiang Tang, Jinhu Qi, Wentao Zhang, Junli Wang, Biao Zhao, Hongyang Du2026-05-07
💻 computer science

Scalable Multi Agent Diffusion Policies for Coverage Control

यह शोध पत्र MADP को प्रस्तुत करता है, जो एक नवीन विकेंद्रीकृत मल्टी-एजेंट डिफ्यूजन पॉलिसी है जो कवरेज कंट्रोल के लिए समन्वित क्रियाएं उत्पन्न करने हेतु स्पैटियल ट्रांसफॉर्मर और पीयर-परसेप्चुअल एम्बेडिंग्स का लाभ उठाता है, जो विभिन्न स्वार्म डेंसिटी और पर्यावरणीय स्थितियों में अत्याधुनिक बेसलाइनों की तुलना में बेहतर सामान्यीकरण और प्रदर्शन प्रदर्शित करता है।

Frederic Vatnsdal, Romina Garcia Camargo, Saurav Agarwal, Alejandro Ribeiro2026-05-07
💻 computer science

SlotVLA: Towards Modeling of Object-Relation Representations in Robotic Manipulation

यह शोध पत्र LIBERO+ का परिचय देता है, जो ऑब्जेक्ट-सेंट्रिक एनोटेशन वाला एक सूक्ष्म-स्तरीय (fine-grained) बेंचमार्क है, और SlotVLA, जो एक स्लॉट-अटेंशन-आधारित फ्रेमवर्क है जो कुशल, व्याख्यात्मक और प्रतिस्पर्धी मल्टीटास्क रोबोटिक मैनिपुलेशन प्राप्त करने के लिए कॉम्पैक्ट ऑब्जेक्ट-रिलेशन रिप्रेजेंटेशन्स का लाभ उठाता है।

Taisei Hanyu, Nhat Chung, Huy Le, Toan Nguyen, Yuki Ikebe, Anthony Gunderman, Duy Nguyen Ho Minh, Khoa Vo, Tung Kieu, Ka (…)2026-05-07
💻 computer science

A Universal Large Language Model -- Drone Command and Control Interface

यह शोध पत्र एक सार्वभौमिक, एगोस्टिक (agnostic) ड्रोन कमांड और कंट्रोल इंटरफेस प्रस्तुत करता है जो मॉडल कॉन्टेक्स्ट प्रोटोकॉल (MCP) का लाभ उठाकर लार्ज लैंग्वेज मॉडल्स (LLMs) को ड्रोन सिस्टम के साथ सहजता से एकीकृत करता है, जिससे LLMs को वैश्विक मैपिंग डेटा और सर्वव्यापी मावलिंक (Mavlink) प्रोटोकॉल से जोड़कर प्राकृतिक भाषा-संचालित उड़ान योजना और वास्तविक समय नेविगेशन सक्षम बनाया जा सके।

Javier N. Ramos-Silva, Peter J. Burke2026-05-07
🤖 machine learning

CLAMP: Contrastive Learning for 3D Multi-View Action-Conditioned Robotic Manipulation Pretraining

यह योगदान CLAMP को प्रस्तुत करता है, जो एक नवीन 3D प्री-ट्रेनिंग फ्रेमवर्क है जो सिम्युलेटेड और वास्तविक दुनिया के कार्यों में रोबोट मैनिपुलेशन पॉलिसियों की सैंपल एफिशिएंसी और प्रदर्शन को बेहतर बनाने के लिए मल्टी-व्यू पॉइंट क्लाउड्स और रोबोटिक एक्शन्स पर कंट्रास्टिव लर्निंग का लाभ उठाता है।

I-Chun Arthur Liu, Krzysztof Choromanski, Sandy Huang, Connor Schenck2026-05-07
💻 computer science

Pack it in: Packing into Partially Filled Containers Through Contact

यह शोध पत्र एक संपर्क-जागरूक पैकिंग दृष्टिकोण प्रस्तुत करता है जो भौतिकी-जागरूक धारणा प्रणाली और एक संपर्क-आधारित बहु-वस्तु प्रक्षेपवक्र अनुकूलक का उपयोग करता है ताकि रोबोटों को आवश्यक स्थान बनाने के लिए मौजूदा वस्तुओं के साथ जानबूझकर परस्पर क्रिया करने और उन्हें पुनर्व्यवस्थित करने के माध्यम से आंशिक रूप से भरे हुए कंटेनरों में नई वस्तुओं को सफलतापूर्वक रखने में सक्षम बनाया जा सके।

David Russell, Zisong Xu, Maximo A. Roa, Mehmet Dogar2026-05-07
🤖 machine learning

Constraint-Enhanced Reinforcement Learning Based on Dynamic Decoupled Spherical Radial Squashing

यह शोध पत्र डायनेमिक डिकपल्ड स्फेरिक रेडियल स्क्वैशिंग (DD-SRad) को प्रस्तुत करता है, जो एक बाधा-संवर्धित सुदृढीकरण शिक्षण (reinforcement learning) विधि है जो स्थिति-अनुकूलित, प्रति-जोड़ त्रिज्याओं की गणना करके विषम एक्चुएटर दर सीमाओं और समदैशिक बाधाओं के बीच ज्यामितीय बेमेल को हल करती है, जिससे शून्य बाधा उल्लंघन, सटीक ग्रेडिएंट बैकप्रोपैगेशन, और सिमुलेशन एवं उच्च-निष्ठा वाले ह्यूमनॉइड रोबोट परिनियोजन दोनों में उत्कृष्ट कार्य प्रदर्शन प्राप्त होता है।

Qijun Liao, Zhaoxin Yu, Jue Yang2026-05-07
🔢 mathematics

Globally Solving Unbalanced Optimal Transport and Density Control for Gaussian Distributions

यह शोध पत्र यह सिद्ध करके कि ये अनंत-आयामी परिवर्तनशील समस्याएँ द्रव्यमान (masses), माध्य (means) और सहप्रसरण (covariances) पर अनुकूलन में सटीक न्यूनीकरण स्वीकार करती हैं, जो अक्सर सेमीडेफिनेट प्रोग्रामिंग और क्लोज्ड-फॉर्म अपडेट्स के माध्यम से हल की जा सकती हैं, गॉसियन वितरणों से जुड़ी असंतुलित इष्टतम परिवहन (unbalanced optimal transport) और असंतुलित घनत्व नियंत्रण (unbalanced density control) समस्याओं के लिए वैश्विक रूप से इष्टतम, परिमित-आयामी समाधान विधियाँ स्थापित करता है।

Haruto Nakashima, Siddhartha Ganguly, Kenji Kashima2026-05-07
💻 computer science

Beyond Fixed Thresholds and Domain-Specific Benchmarks for Explainable Multi-Task Classification in Autonomous Vehicles

यह शोध पत्र मल्टी-टास्क ऑटोनॉमस ड्राइविंग परसेप्शन में फिक्स्ड थ्रेशोल्ड की सीमाओं को दूर करने के लिए एक एडेप्टिव थ्रेशोल्ड सिलेक्शन कार्यप्रणाली प्रस्तावित करता है और क्रॉस-कल्चरल व्याख्यात्मकता तथा ऑटोनॉमस वाहन प्रणालियों के अधिक सुदृढ़ मूल्यांकन को सक्षम करने के लिए IUST-XAI-AD डेटासेट पेश करता है।

Maryam Sadat Hosseini Azad, Shahriar Baradaran Shokouhi2026-05-07
⚡ electrical engineering

Tightly-Coupled Estimation and Guidance for Robust Low-Thrust Rendezvous via Adaptive Homotopy

यह शोध पत्र एक सुदृढ़ लो-थ्रस्ट रेंडेवूव गाइडेंस आर्किटेक्चर प्रस्तावित करता है जो एक कलमान फिल्टर को एडेप्टिव होमोटोपी-आधारित ऑप्टिमल कंट्रोल के साथ मजबूती से जोड़ता है, जो सेंसर डिग्रेडेशन के दौरान नियंत्रण रणनीति को एक रूढ़िवादी शासन (कंजर्वेटिव रिजीम) में गतिशील रूप से शिथिल करता है ताकि उप-मीटर टर्मिनल सटीकता प्राप्त की जा सके जहाँ पारंपरिक फिक्स्ड-एप्सिलॉन विधियाँ विफल हो जाती हैं।

Batu Candan, Simone Servadio2026-05-07