💻 computer science

Talk, Judge, Cooperate: Gossip-Driven Indirect Reciprocity in Self-Interested LLM Agents

यह शोध पत्र ALIGN को प्रस्तुत करता है, जो एक विकेंद्रीकृत गॉसिप फ्रेमवर्क है जो स्वार्थी LLM एजेंटों को प्रतिष्ठा संबंधी जानकारी रणनीतिक रूप से साझा करके अप्रत्यक्ष पारस्परिकता बनाए रखने और दुर्भावनापूर्ण डिफेक्टर्स का प्रतिरोध करने में सक्षम बनाता है, यह प्रकट करते हुए कि चैट मॉडल की तुलना में मजबूत तर्क क्षमताएं अधिक प्रोत्साहन-संरेखित सहयोग को बढ़ावा देती हैं।

Shuhui Zhu, Yue Lin, Shriya Kaistha, Wenhao Li, Baoxiang Wang, Hongyuan Zha, Gillian K. Hadfield, Pascal Poupart2026-05-20
💻 computer science

ClinQueryAgent: A Conversational Agent for Population Health Management

यह शोध पत्र ClinQueryAgent को प्रस्तुत करता है, जो एक सुरक्षित संवादात्मक प्रणाली है जो स्वास्थ्य सेवा कर्मियों को एक मल्टी-एजेंट आर्किटेक्चर के माध्यम से प्रश्नों को निष्पादन योग्य डेटाबेस कमांड में अनुवादित करके प्राकृतिक भाषा का उपयोग करके रोगी रिकॉर्ड से कार्रवाई योग्य अंतर्दृष्टि उत्पन्न करने में सक्षम बनाती है, जबकि यह सुनिश्चित करती है कि रोगी का डेटा सुरक्षित स्थानीय वातावरण के भीतर ही रहे।

Joseph S. Boyle, Anthony Dranfield, Mike O'Neil, Maria Liakata, Alison Q. Smithard2026-05-20
🧬 biology

The fitness landscape of social norms in social dilemmas

यह शोध पत्र सामाजिक मानदंडों के विकासवादी गेम थ्योरी को मैट्रिक्स गेम्स से अधिक सामान्य मार्कोव गेम सेटिंग तक विस्तारित करता है, जो तर्कसंगत संकेत व्याख्या के माध्यम से मानदंड कैसे विकसित होते हैं इसके अंतर्निहित तंत्र को स्पष्ट करता है और सामाजिक दुविधाओं में उनके उद्भव को नियंत्रित करने वाले रेप्लिकेटर डायनेमिक्स के लिए एक सामान्य समाधान प्रदान करता है।

Maximilian Puelma Touzel2026-05-20
🔬 physics

Stop Drawing Scientific Claims from LLM Social Simulations Without Robustness Audits

यह शोध पत्र तर्क देता है कि LLM सामाजिक सिमुलेशन से प्राप्त वैज्ञानिक दावे अक्सर कार्यान्वयन के सूक्ष्म विवरणों के प्रति उच्च संवेदनशीलता के कारण कमजोर हो जाते हैं, और यह एजेंट, इंटरेक्शन और सिस्टम स्तरों पर मजबूती ऑडिट को एक अनिवार्य सत्यापन आवश्यकता के रूप में स्थापित करने के लिए TRAILS वर्गीकरण का प्रस्ताव करता है।

Jinyi Ye, Lei Cao, Ding Chen, Emilio Ferrara2026-05-20
🤖 AI

RLFTSim: Realistic and Controllable Multi-Agent Traffic Simulation via Reinforcement Learning Fine-Tuning

RLFTSim एक सुदृढीकरण अधिगम (reinforcement learning) आधारित फाइन-ट्यूनिंग फ्रेमवर्क है जो सिम्युलेटर रोलआउट्स को वास्तविक दुनिया के डेटा वितरण के साथ संरेखित करके और स्टेट-ऑफ-द-आर्ट प्रदर्शन प्राप्त करने के लिए एक कम-विचलन वाले, सघन रिवॉर्ड सिग्नल का उपयोग करके मल्टी-एजेंट ट्रैफिक सिमुलेशन की वास्तविकता और नियंत्रणीयता को बढ़ाता है, जैसा कि वेमो ओपन मोशन डेटासेट (Waymo Open Motion Dataset) पर देखा गया है।

Ehsan Ahmadi, Hunter Schofield, Behzad Khamidehi, Fazel Arasteh, Jinjun Shan, Lili Mou, Dongfeng Bai, Kasra Rezaee2026-05-20
🤖 AI

DecisionBench: A Benchmark for Emergent Delegation in Long-Horizon Agentic Workflows

यह शोधपत्र DecisionBench को प्रस्तुत करता है, जो विविध मॉडलों और कार्यों में दीर्घ-क्षितिज (long-horizon) एजेंटिक वर्कफ़्लो के उभरते हुए डेलीगेशन (delegation) के मूल्यांकन के लिए एक व्यापक बेंचमार्क सबस्ट्रेट है, जो यह प्रकट करता है कि जबकि जागरूकता स्थितियों (awareness conditions) में कार्य की गुणवत्ता स्थिर रहती है, रूटिंग फिडेलिटी (routing fidelity) और समग्र ऑर्केस्ट्रेशन प्रदर्शन को सुधारने के लिए महत्वपूर्ण अप्राप्त क्षमता मौजूद है।

Yuxuan Gao, Megan Wang, Yi Ling Yu, Zijian Carl Ma, Ao Qu2026-05-20
🤖 AI

How Far Are We From True Auto-Research?

यह शोधपत्र रिसर्चएरिना (ResearchArena) का परिचय देता है, जो स्वायत्त अनुसंधान एजेंटों के मूल्यांकन के लिए एक ढांचा है, और यह पाता है कि हालांकि वे ऐसे पांडुलिपियां तैयार कर सकते हैं जो सतही समीक्षा के तहत प्रतिस्पर्धी प्रतीत होती हैं, लेकिन वे अंततः प्रयोगात्मक कठोरता से जुड़ी महत्वपूर्ण समस्याओं, जिनमें फर्जी परिणाम और योजना-कार्यान्वयन विसंगतियां शामिल हैं, के कारण शीर्ष स्तर का अनुसंधान करने में विफल रहते हैं।

Zhengxin Zhang, Ning Wang, Sainyam Galhotra, Claire Cardie2026-05-20
💻 computer science

Graph Neural Planning and Predictive Control for Multi-Robot Communication-Constrained Unlabeled Motion Planning

यह शोधपत्र संचार बाधाओं और गैररेखीय गतिकी (nonlinear dynamics) के तहत मल्टी-रोबोट अनलेबल मोशन प्लानिंग समस्या को हल करने के लिए एक ग्राफ अटेंशन प्लानर (Graph Attention Planner) के साथ एक विकेंद्रीकृत नॉनलीनियर मॉडल प्रेडिक्टिव कंट्रोलर (Nonlinear Model Predictive Controller) को संयोजित करने वाला एक पदानुक्रमित ढांचा प्रस्तावित करता है, जो सिमुलेशन और वास्तविक दुनिया के क्वाड्रोटर प्रयोगों दोनों में मजबूती और स्केलेबिलिटी प्रदर्शित करता है।

Manohari Goarin, Yang Zhou, Giuseppe Loianno2026-05-20
💻 computer science

CASPIAN: Online Detection and Attribution of Cascade Attacks in LLM Multi-Agent Systems via Cross-Channel Causal Monitoring

CASPIAN एक नवीन ढांचा है जो एक एकीकृत कंडीशनल ट्रांसफर एंट्रॉपी दृष्टिकोण के माध्यम से गतिशील क्रॉस-चैनल प्रभाव प्रसार को मॉडल करके, LLM मल्टी-एजेंट सिस्टम में कैस्केड हमलों का ऑनलाइन पता लगाने और उनके कारण संबंधी एट्रिब्यूशन को सक्षम बनाता है, जो सटीकता और विलंबता में मौजूदा स्थानीय सुरक्षा प्रणालियों से बेहतर प्रदर्शन करता है।

Kavana Venkatesh, Jafar Isbarov, Saad Amin, Murat Kantarcioglu, Jiaming Cui2026-05-20
🤖 AI

AQuaUI: Visual Token Reduction for GUI Agents with Adaptive Quadtrees

AquaUI एक ट्रेनिंग-मुक्त, इन्फरेंस-टाइम टोकन रिडक्शन विधि है जो GUI एजेंटों के लिए एडेप्टिव क्वाडट्रीज़ (adaptive quadtrees) का उपयोग करती है ताकि स्क्रीनशॉट के गैर-समान स्थानिक सूचना घनत्व (non-uniform spatial information density) का लाभ उठाया जा सके, जिससे मल्टी-स्टेप इंटरैक्शन में लगभग पूर्ण प्रदर्शन और टेम्पोरल कंसिस्टेंसी बनाए रखते हुए महत्वपूर्ण गति और टोकन में कमी प्राप्त होती है।

Yuankai Li, Tinghui Zhu, Ha Min Son, Zhe Zhao, Xin Liu, Muhao Chen2026-05-20