💻 computer science

Do LLMs Need to See Everything? A Benchmark and Study of Failures in LLM-driven Smartphone Automation using Screentext vs. Screenshots

यह शोधपत्र डेलीड्रॉइड (DailyDroid) को प्रस्तुत करता है, जो 75 स्मार्टफोन ऑटोमेशन कार्यों का एक बेंचमार्क है, जिसका उपयोग केवल टेक्स्ट-आधारित बनाम मल्टीमॉडल इनपुट का उपयोग करने वाले एलएलएम-संचालित (LLM-driven) एजेंटों के विफलता मोड का मूल्यांकन और विश्लेषण करने के लिए किया गया है, जो यह प्रकट करता है कि हालांकि मल्टीमॉडल इनपुट मामूली सुधार प्रदान करते हैं, फिर भी यूआई (UI) सुलभता और मॉडल डिजाइन में महत्वपूर्ण समस्याएं बनी हुई हैं।

Shiquan Zhang, Tianyi Zhang, Le Fang, Simon D'Alfonso, Hong Jia, Vassilis Kostakos2026-04-21
💬 NLP

Diversity Collapse in Multi-Agent LLM Systems: Structural Coupling and Collective Failure in Open-Ended Idea Generation

यह शोध पत्र प्रकट करता है कि मल्टी-एजेंट एलएलएम (LLM) सिस्टम अक्सर ओपन-एंडेड विचार सृजन में "डाइवर्सिटी कोलैप्स" (विविधता पतन) से ग्रस्त होते हैं, जो स्ट्रक्चरल कपलिंग (संरचनात्मक युग्मन) के कारण होता है—जहाँ शक्तिशाली मॉडल, अधिकार-संचालित पदानुक्रम और सघन संचार नेटवर्क अनजाने में सिमेंटिक विविधता को दबा देते हैं और समयपूर्व अभिसरण (प्रिमचर कन्वर्जेंस) को ट्रिगर करते हैं—जो रचनात्मक अन्वेषण को बनाए रखने के लिए एजेंट स्वतंत्रता और असहमति को संरक्षित करने की महत्वपूर्ण आवश्यकता पर प्रकाश डालता है।

Nuo Chen, Yicheng Tong, Yuzhe Yang, Yufei He, Xueyi Zhang, Zou Qingyun, Qian Wang, Bingsheng He2026-04-21
💻 computer science

EvoMarket: A High-Fidelity and Scalable Financial Market Simulator

यह शोधपत्र EvoMarket को प्रस्तुत करता है, जो एक स्केलेबल, डिस्क्रीट-इवेंट मल्टी-एजेंट वित्तीय बाजार सिम्युलेटर है जो विशिष्ट रूप से हाई-फिडेलिटी माइक्रोस्ट्रक्चर मॉडलिंग, संस्थागत तंत्रों और एक ओरकल-गाइडेड सेल्फ-कैलिब्रेशन सिस्टम को जोड़ता है ताकि मल्टी-एसेट और क्रॉस-डे परिवेशों में यथार्थवादी, बड़े पैमाने के हस्तक्षेप प्रयोगों और नीति विश्लेषण को सक्षम बनाया जा सके।

Muyao Zhong, Zhenhua Yang, Yuxiang Liu, Ke Tang, Peng Yang2026-04-21
💰 quantitative finance

QRAFTI: An Agentic Framework for Empirical Research in Quantitative Finance

QRAFTI एक मल्टी-एजेंट फ्रेमवर्क है जिसे पैनल डेटा टूलकिट को MCP सर्वर के साथ एकीकृत करके एक क्वांटिटेटिव रिसर्च टीम के अनुकरण के लिए डिज़ाइन किया गया है ताकि इक्विटी फैक्टर रिसर्च को सुगम बनाया जा सके, जिससे स्थापित कारकों की प्रतिकृति बनाना, नए सिग्नल्स का परीक्षण करना और नैरेटिव विश्लेषण एवं कम्प्यूटेशनल ट्रेसेस के साथ मानकीकृत रिपोर्ट तैयार करना सक्षम हो सके।

Terence Lim, Kumar Muthuraman, Michael Sury2026-04-21
🤖 AI

Towards Understanding, Analyzing, and Optimizing Agentic AI Execution: A CPU-Centric Perspective

यह शोध पत्र निष्पादन पैटर्न (execution patterns) को अभिलक्षित करके और दो शेड्यूलिंग अनुकूलन, COMB और MAS का प्रस्ताव देकर, एजेंटिक एआई सर्विंग (Agentic AI serving) में उपेक्षित सीपीयू-केंद्रित बाधाओं को संबोधित करता है, जो विषम सीपीयू-जीपीयू प्रणालियों (heterogeneous CPU-GPU systems) पर विलंबता (latency) को काफी कम करते हैं और संसाधन उपयोगिता में सुधार करते हैं।

Ritik Raj, Souvik Kundu, Ishita Vohra, Hong Wang, Tushar Krishna2026-04-20
💻 computer science

SocialWise: LLM-Agentic Conversation Therapy for Individuals with Autism Spectrum Disorder to Enhance Communication Skills

सोशलवाइज़ (SocialWise) एक स्केलेबल, ब्राउज़र-आधारित एप्लिकेशन है जो ऑटिज़्म स्पेक्ट्रम डिसऑर्डर वाले व्यक्तियों को उनके संचार कौशल को बढ़ाने के लिए ऑन-डिमांड, साक्ष्य-आधारित बातचीत का अभ्यास और तत्काल, संरचित फीडबैक प्रदान करने के लिए एलएलएम (LLM) एजेंटों और एक चिकित्सीय ज्ञान आधार का लाभ उठाता है।

Albert Tang2026-04-20
🤖 AI

InfoChess: A Game of Adversarial Inference and a Laboratory for Quantifiable Information Control

यह शोध पत्र InfoChess प्रस्तुत करता है, जो एक नवीन प्रतिकूल खेल (adversarial game) है जिसे आंशिक दृश्यता (partial observability) के तहत मल्टी-एजेंट अनुमान का अध्ययन करने के लिए एक टेस्टबेड के रूप में डिज़ाइन किया गया है, जिसमें मोहरे की कैप्चरिंग को राजा के स्थान पर आधारित संभाव्य स्कोरिंग से प्रतिस्थापित किया गया है, और यह रणनीतिक सूचना नियंत्रण के विश्लेषण के लिए नए सूचना-सैद्धांतिक मेट्रिक्स के साथ सुदृढीकरण शिक्षण (reinforcement learning) एजेंटों की प्रभावशीलता को प्रदर्शित करता है।

Kieran A. Murphy2026-04-20
💻 computer science

NeuroMesh: A Unified Neural Inference Framework for Decentralized Multi-Robot Collaboration

न्यूरोमेश (NeuroMesh) एक एकीकृत, विकेंद्रीकृत न्यूरल इन्फरेंस फ्रेमवर्क है जो विविध रोबोट टीमों में सुदृढ़ सहयोगात्मक धारणा, नियंत्रण और कार्य आवंटन को सक्षम करने के लिए निष्पादन पाइपलाइन को मानकीकृत करके और जेनोह-आधारित (Zenoh-based) संचार का लाभ उठाकर मल्टी-रोबोट प्रणालियों में हार्डवेयर विषमता और संचार बाधाओं को संबोधित करता है।

Yang Zhou, Yash Shetye, Long Quang, Devon Super, Jesse Milzman, Manohari Goarin, Aditya Azad, Devang Sunil Dhake, Jeffer (…)2026-04-20
💻 computer science

Scalable Algorithms with Provable Optimality Bounds for the Multiple Watchman Route Problem

यह शोध पत्र MWRP-CP3 प्रस्तुत करता है, जो एक कुशल इष्टतम प्लैनर (optimal planner) है जो 200 गुना से अधिक की गति वृद्धि के साथ मल्टीपल वॉचमैन रूट प्रॉब्लम को हल करने के लिए स्टेट-स्पेस प्रूनिंग और उन्नत ह्यूरिस्टिक्स का उपयोग करता है, साथ ही इसमें प्रमाणित इष्टतम सीमाओं वाले स्केलेबल उपइष्टतम (suboptimal) एल्गोरिदम भी हैं जो तीन गुना बड़े मानचित्रों को संभालने में सक्षम हैं।

Srikar Gouru, Ariel Felner, Jiaoyang Li2026-04-20
💬 NLP

Polarization by Default: Auditing Recommendation Bias in LLM-Based Content Curation

यह अध्ययन प्रकट करता है कि LLM-आधारित सामग्री क्यूरेशन व्यवस्थित रूप से ध्रुवीकरण को बढ़ाता है और विषाक्तता प्रबंधन तथा भावना (sentiment) में विशिष्ट, प्रदाता-विशिष्ट पूर्वाग्रह प्रदर्शित करता है, जबकि प्रॉम्प्टिंग रणनीतियों के बावजूद ट्विटर/X पर लगातार वामपंथी लेखकों का अधिक प्रतिनिधित्व करता है।

Nicolò Pagan, Christopher Barrie, Chris Andrew Bail, Petter Törnberg2026-04-20