💻 computer science

Neural Network-Based Parameter Estimation of a Labour Market Agent-Based Model

यह अध्ययन प्रदर्शित करता है कि एक न्यूरल नेटवर्क-आधारित सिमुलेशन इन्फरेंस फ्रेमवर्क एक बड़े पैमाने के लेबर मार्केट एजेंट-बेस्ड मॉडल में मापदंडों का प्रभावी और कुशल अनुमान लगाता है, जो विभिन्न डेटासेट स्केल्स में मूल मापदंडों को पुनः प्राप्त करने में पारंपरिक बेयसियन विधियों और सारांश सांख्यिकी (समरी स्टैटिस्टिक्स) से बेहतर प्रदर्शन करता है।

M Lopes Alves, Joel Dyer, Doyne Farmer, Michael Wooldridge, Anisoara Calinescu2026-03-06
💻 computer science

Assessing Risks of Large Language Models in Mental Health Support: A Framework for Automated Clinical AI Red Teaming

यह शोध पत्र एक सिमुलेशन-आधारित क्लिनिकल रेड टीमिंग फ्रेमवर्क पेश करता है जो मानसिक स्वास्थ्य सहायता प्रणालियों का मूल्यांकन करने के लिए एआई मनोचिकित्सकों को गतिशील रोगी एजेंटों के साथ जोड़ता है, जो अल्कोहल यूज़ डिसऑर्डर परिदृश्यों के विरुद्ध परीक्षण किए गए एआई एजेंटों में भ्रमों की पुष्टि और आत्महत्या के जोखिम को कम करने में विफलता जैसे महत्वपूर्ण सुरक्षा अंतराल को प्रकट करता है।

Ian Steenstra, Paola Pedrelli, Weiyan Shi, Stacy Marsella, Timothy W. Bickmore2026-03-06
💻 computer science

Graph-theoretic Agreement Framework for Multi-agent LLM Systems

यह शोध पत्र एक कठोर ग्राफ-सैद्धांतिक ढांचे को स्थापित करता है जो मल्टी-एजेंट एलएलएम (LLM) प्रणालियों में आम सहमति की स्थिरता का विश्लेषण करने के लिए ट्रांसफॉर्मर क्रॉस-एन्ट्रॉपी लॉग-ऑड्स को हस्ताक्षरित लैपलेसियन (signed Laplacians) में मैप करता है, जो यह प्रदर्शित करता है कि कैसे संरचनात्मक संतुलन सिद्धांत अदृश्य विलुप्त अवस्थाओं (unobservable latent states) के कारण होने वाले तर्क संबंधी दोलनों (reasoning oscillations) की पहचान करता है और इन गतिरोधों को नियत रूप से हल करने के लिए स्पेक्ट्रल विक्षोभ (spectral perturbations) के साथ कॉर्डल ग्राफ टोपोलॉजी का प्रस्ताव करता है।

Muhammad Umar Javed2026-03-06
💻 computer science

Do Mixed-Vendor Multi-Agent LLMs Improve Clinical Diagnosis?

यह शोध पत्र यह प्रदर्शित करता है कि मिश्रित-विक्रेता (mixed-vendor) बड़े भाषा मॉडल का लाभ उठाने वाले मल्टी-एजेंट नैदानिक निदान तंत्र, साझा विफलता मोड (shared failure modes) को दूर करने के लिए पूरक प्रेरणात्मक पूर्वाग्रहों (complementary inductive biases) को एकत्रित करके, एकल-विक्रेता ढाँचों की तुलना में काफी बेहतर प्रदर्शन करते हैं और अत्याधुनिक नैदानिक सटीकता प्राप्त करते हैं।

Grace Chang Yuan, Xiaoman Zhang, Sung Eun Kim, Pranav Rajpurkar2026-03-06
🔒 cryptography

Beyond Input Guardrails: Reconstructing Cross-Agent Semantic Flows for Execution-Aware Attack Detection

यह शोध पत्र \SysName को प्रस्तुत करता है, जो एक नवीन फ्रेमवर्क है जो क्रॉस-एजेंट सिमेंटिक फ्लो (Cross-Agent Semantic Flows) के पुनर्निर्माण के माध्यम से निष्पादन-जागरूक विश्लेषण (execution-aware analysis) की ओर स्थानांतरित होकर मल्टी-एजेंट सिस्टम सुरक्षा को बढ़ाता है, जिससे उन जटिल हमले के वेक्टर्स का प्रभावी ढंग से पता लगाया जा सके जो पारंपरिक गार्डरेल्स को बायपास कर देते हैं।

Yangyang Wei, Yijie Xu, Zhenyuan Li, Xiangmin Shen, Shouling Ji2026-03-06
💻 computer science

Adaptive Memory Admission Control for LLM Agents

यह शोध पत्र एडेप्टिव मेमोरी एडमिशन कंट्रोल (A-MAC) का प्रस्ताव करता है, जो एक ऐसा फ्रेमवर्क है जो LLM एजेंटों के लिए पारदर्शी, कुशल और डोमेन-अनुकूली दीर्घकालिक मेमोरी प्रबंधन को सक्षम करने हेतु मेमोरी वैल्यू को पांच व्याख्यात्मक कारकों में विभाजित करता है, जिससे अत्याधुनिक प्रणालियों की तुलना में बेहतर प्रिसिजन-रिकॉल ट्रेडऑफ़ और कम लेटेंसी प्राप्त होती है।

Guilin Zhang, Wei Jiang, Xiejiashan Wang, Aisha Behr, Kai Zhao, Jeffrey Friedman, Xu Chu, Amine Anoun2026-03-06
🤖 machine learning

RepoLaunch: Automating Build&Test Pipeline of Code Repositories on ANY Language and ANY Platform

यह शोध पत्र RepoLaunch को प्रस्तुत करता है, जो एक ऐसा एजेंट है जो किसी भी भाषा और प्लेटफॉर्म के कोड रिपॉजिटरी के लिए बिल्ड और टेस्ट पाइपलाइन को स्वचालित करता है, जिससे बेंचमार्किंग और कोडिंग एजेंटों के प्रशिक्षण के लिए सॉफ्टवेयर इंजीनियरिंग डेटासेट का पूर्णतः स्वचालित निर्माण सक्षम होता है।

Kenan Li, Rongzhi Li, Linghao Zhang, Qirui Jin, Liao Zhu, Xiaosong Huang, Geng Zhang, Yikai Zhang, Shilin He, Chengxing (…)2026-03-06
💻 computer science

Greedy-based Value Representation for Optimal Coordination in Multi-agent Reinforcement Learning

यह शोध पत्र ग्रीडी-आधारित वैल्यू रिप्रेजेंटेशन (GVR) पद्धति का प्रस्ताव करता है, जो निम्नतर लक्ष्य शेपिंग (inferior target shaping) और श्रेष्ठ अनुभव पुनर्रचना (superior experience replay) के माध्यम से इष्टतम नोड को एक अद्वितीय स्व-संक्रमण (self-transition) में परिवर्तित करके मल्टी-एजेंट सुदृढीकरण शिक्षण में सापेक्ष अति-सामान्यीकरण (relative overgeneralization) और इष्टतम निरंतरता (optimal consistency) संबंधी मुद्दों को संबोधित करता है, जिससे यह विभिन्न बेंचमार्क पर अत्याधुनिक बेसलाइनों से बेहतर प्रदर्शन करता है।

Lipeng Wan, Zeyang Liu, Xingyu Chen, Han Wang, Xuguang Lan2026-03-05
💻 computer science

\aleph-IPOMDP: Mitigating Deception in a Cognitive Hierarchy with Off-Policy Counterfactual Anomaly Detection

यह शोध पत्र \aleph-IPOMDP प्रस्तुत करता है, जो एक कम्प्यूटेशनल ढांचा है जो मॉडल-आधारित सुदृढीकरण लर्निंग (reinforcement learning) एजेंटों को विसंगति पहचान (anomaly detection) और आउट-ऑफ-बलीफ (out-of-belief) नीतियों से सुसज्जित करता है ताकि अधिक परिष्कृत विरोधियों से होने वाले धोखे की पहचान और रोकथाम की जा सके, जिससे मिश्रित-उद्देश्य (mixed-motive) और शून्य-योग (zero-sum) खेलों में शोषण को कम किया जा सके।

Nitay Alon, Joseph M. Barnby, Stefan Sarkadi, Lion Schulz, Jeffrey S. Rosenschein, Peter Dayan2026-03-05
🤖 AI

Agile Flight Emerges from Multi-Agent Competitive Racing

यह शोध पत्र यह प्रदर्शित करता है कि रेसिंग कार्यों में प्रतिस्पर्धा करने के लिए कई एजेंटों को स्पार्स हाई-लेवल रिवार्ड्स के साथ प्रशिक्षित करना प्रभावी रूप से चुस्त उड़ान व्यवहार और रणनीतिक क्षमताएं उत्पन्न करता है जो एकल प्रशिक्षण विधियों से बेहतर हैं, जिससे जटिल भौतिक वातावरण में श्रेष्ठ सिम-टू-रियल ट्रांसफर और सामान्यीकरण प्राप्त होता है।

Vineet Pasumarti, Lorenzo Bianchi, Antonio Loquercio2026-03-05