🤖 AI

UC-PSRO: Utility-Conditioned Policy-Space Response Oracles with a Communication-Dropout Curriculum for Game-Theoretic Course-of-Action Generation in Adversarial Swarms

यह शोध पत्र UC-PSRO का प्रस्ताव देता है, जो प्रतिकूल UAS झुंडों (swarms) के लिए गेम-थ्योरेटिक कोर्स ऑफ एक्शन उत्पन्न करने हेतु एक ढांचा है जो सेल्फ-प्ले, यूटिलिटी-कंडीशनिंग और कम्युनिकेशन-ड्रॉपआउट करिकुलम को जोड़ता है, जिससे यह पता चलता है कि जबकि कम्युनिकेशन ड्रॉपआउट निम्नीकृत वातावरण में मजबूती को महत्वपूर्ण रूप से बढ़ाता है, सेल्फ-प्ले और यूटिलिटी-कंडीशनिंग की अतिरिक्त जटिलता वर्तमान में बिना किसी सांख्यिकीय रूप से महत्वपूर्ण मजबूती लाभ के अभिसरण लागत (convergence costs) उत्पन्न करती है।

Phillip Jiang2026-08-18
💻 computer science

Marker-Constrained Pose-Graph Correction for Cross-Platform Georeferencing in GNSS-Denied Environments

यह शोध पत्र पूर्व-सर्वेक्षण किए गए, छलावरण-युक्त कोलेस्टेरिक स्फेरिक रिफ्लेक्टर (CSR) मार्कर्स का उपयोग करके GNSS-रहित वातावरण में स्वायत्त नेविगेशन के भू-संदर्भित (georeferencing) करने के लिए एक वास्तविक समय के ढांचे का प्रस्ताव करता है, ताकि ड्रिफ्ट को ठीक किया जा सके और विषम LiDAR-ओडोमेट्री तथा सघन पुनर्निर्माण प्रक्षेप पथों को एक सामान्य समन्वय प्रणाली के भीतर संरेखित किया जा सके, जिससे पुनरावृत्ति विसंगति (revisit inconsistency) में 97% से अधिक की कमी आती है।

Marco Giberna, Jose Luis Sanchez Lopez, Holger Voos2026-08-18
💻 computer science

KC-BFPRL: Knowledge-Guided Multi-UAV Collaboration for Grassland Restoration via Bilevel Formerpointer-Based Reinforcement Learning

यह शोध पत्र KC-BFPRL का प्रस्ताव करता है, जो एक ज्ञान-निर्देशित बाइलेवल सुदृढीकरण शिक्षण (bilevel reinforcement learning) ढांचा है जो बड़े पैमाने पर घास के मैदानों के पुनरुद्धार के लिए बहु-UAV बेड़े को प्रभावी ढंग से समन्वित करने हेतु जटिल पुनरुद्धार क्षेत्र अधिकतमकरण समस्या को पदानुक्रमित नियोजन कार्यों में विभाजित करता है, जिससे अत्याधुनिक विधियों की तुलना में बेहतर दक्षता और बाधा संतुष्टि प्राप्त होती है।

Dongbin Jiao, Xianyi Wang, Yuchen Yuan, Weibo Yang, Peng Yang, Peng Zhao, Zhanhuan Shang, Shi Yan2026-08-18
🤖 AI

MELD: A Protocol for Merging Knowledge Across Distributed Agentic Memories

यह शोध पत्र MELD प्रस्तुत करता है, जो एक स्व-प्रबंधित प्रोटोकॉल है जो ऑडिट योग्य पैच और CRDT-आधारित स्थिति ट्रैकिंग के माध्यम से वितरित स्वायत्त एजेंटों को अपने ज्ञान ग्राफ (knowledge graphs) को सुसंगत बनाने और विलय करने में सक्षम बनाता है, जो बिना किसी केंद्रीय समन्वयक के बाद के निर्णय के लिए विरोधाभासों को सुरक्षित रखते हुए उच्च रिकॉल और भंडारण दक्षता प्राप्त करता है।

Lauri Lovén, Jaakko Sauvola, Jukka Riekki, Sasu Tarkoma2026-08-18
🤖 AI

VCE-Skill: Enhancing Skill Self-Evolution with Version-Change Experience

यह शोध पत्र VCE-Skill का प्रस्ताव करता है, जो एक नवीन ढांचा है जो सार्वजनिक कौशल संस्करण इतिहासों से आसत (distilled), संरचित अनुभव के साथ कार्य-विशिष्ट निष्पादन प्रक्षेपवक्रों को अनुकूल रूप से संलयित करके एजेंट कौशल स्व-विकास को बढ़ाता है, जिसके परिणामस्वरूप महत्वपूर्ण प्रदर्शन सुधार और मजबूत क्रॉस-मॉडल स्थानांतरण क्षमताएं प्राप्त होती हैं।

Jianming Chen, Xuanbin Ye, Yawen Wang, Junjie Wang, Qing Wang, Fanjiang XU2026-08-18
🤖 AI

Physics of Agents: Statistical Mechanics Predicts Collective Behavior of AI Agents

यह शोध पत्र यह प्रदर्शित करता है कि विविध समुदायों में परस्पर क्रिया करने वाले 10,000 से अधिक एआई एजेंटों का सामूहिक व्यवहार सांख्यिकीय-यांत्रिकी औपचारिकता द्वारा सटीक रूप से पूर्वानुमानित और व्याख्यायित किया जा सकता है, जो सामाजिक दबाव को कम करने की एजेंटों की प्रवृत्ति द्वारा संचालित तीन विशिष्ट गतिशील व्यवस्थाओं (उदासीनता, ध्रुवीकरण और आम सहमति) को प्रकट करता है।

Batu El, Jinhee Paeng, Fatih Dinc, Shiye Su, Mete Erdogan, Aneesh Pappu, Haotian Ye, Wanjia Zhao, Surya Ganguli, James Z (…)2026-08-18
🤖 AI

Reconstruction: A Blind Benchmark for Recovering Research Ideas from Pre-Publication Bibliographies

यह शोध पत्र "रिकंस्ट्रक्शन" (Reconstruction) प्रस्तुत करता है, जो एक ब्लाइंड बेंचमार्क है जिसे यह परीक्षण करने के लिए डिज़ाइन किया गया है कि क्या भाषा मॉडल केवल अपने प्रकाशन-पूर्व संदर्भों (bibliographies) का उपयोग करके प्रकाशित शोध पत्रों के मूल शोध विचारों को पुनः प्राप्त कर सकते हैं, जो यह प्रकट करता है कि जहाँ एकल मॉडल मामूली सफलता प्राप्त करते हैं, वहीं क्रॉस-मॉडल समीक्षा और टूर्नामेंट चयन को संयोजित करने वाला एक मल्टी-एजेंट पाइपलाइन रिकवरी दर को महत्वपूर्ण रूप से बढ़ाकर 23-42% कर देता है।

Shaolong Chen, Yanlin Fei, Nazhou Liu, Xinmiao Yu, Lei Li, Rahul Thapa, Madalina Ciobanu, Qingqing Mao, Ritankar Das2026-08-18
⚡ electrical engineering

Musical Agent Systems: MACAT and MACataRT

यह शोध पत्र MACAT और MACataRT को प्रस्तुत करता है, जो दो मानव-इन-द-लूप जनरेटिव एआई सिस्टम हैं जिन्हें नैतिक जुड़ाव और कलात्मक अखंडता को प्राथमिकता देने वाले व्यक्तिगत, छोटे-डेटासेट प्रशिक्षण के माध्यम से वास्तविक समय के संगीत प्रदर्शन और सहयोगात्मक सुधार (इम्प्रोवाइजेशन) को बढ़ाने के लिए डिज़ाइन किया गया है।

Keon Ju M. Lee, Philippe Pasquier2026-08-17
💻 computer science

Effective Game-Theoretic Motion Planning via Nested Search

यह शोध पत्र गेम-थ्योरेटिक नेस्टेड सर्च (GTNS) को प्रस्तुत करता है, जो एक स्केलेबल और प्रमाणित रूप से सही एल्गोरिदम है जो एक्शन स्पेस को कुशलतापूर्वक खोजकर और गैर-इक्विलिब्रियम प्रक्षेप पथों (non-equilibrium trajectories) को फ़िल्टर करके सामान्य डायनेमिकल सिस्टम्स के लिए नैश इक्विलिब्रिया (Nash Equilibria) की गणना करता है, जिससे सरल डायनेमिक्स या व्यापक प्रक्षेप पथ गणना पर निर्भर रहे बिना स्वायत्त ड्राइविंग जैसे जटिल परिदृश्यों में सुरक्षित, व्यवहार-जागरूक मल्टी-एजेंट प्लानिंग सक्षम होती है।

Avishav Engle, Andrey Zhitnikov, Oren Salzman, Omer Ben-Porat, Kiril Solovey2026-08-17
💻 computer science

Beyond Simplification: DFT-GEN for Fidelity-Preserving Visual Accessibility in Dyslexia-Friendly Educational Texts

यह शोध पत्र DFT-GEN प्रस्तुत करता है, जो एक हितधारक-सूचित ढांचा है जो एक नियतात्मक नियंत्रक (deterministic controller) का उपयोग करके लेआउट और स्वरूपण को अनुकूलित करते हुए और एक विशेष नैदानिक मूल्यांकन के माध्यम से महत्वपूर्ण सूचना की सत्यता को सख्ती से संरक्षित करते हुए, सघन शैक्षिक ग्रंथों में डिस्लेक्सिक पाठकों के लिए दृश्य सुलभता को बढ़ाता है।

Jiaqian Yu, Chen Jason Zhang, Haoyang Li, Guoqiong Ivanka Huang2026-08-17