🤖 AI

Why Git Is the Memory Solution for the Agentic Development Lifecycle

यह शोध पत्र तर्क देता है कि बाहरी रिट्रीवल मशीनरी पर निर्भर रहने के बजाय Git के माध्यम से एजेंटिक डेवलपमेंट लाइफसाइकिल में मेमोरी को एकीकृत करना एक रूटेड सिस्टम को सक्षम बनाता है जो उच्च पर्याप्तता और न्यूनतम टोकन उपयोग के साथ निर्णय के तर्कों का पुनर्निर्माण करता है और वर्जन कंट्रोल के माध्यम से ग्राउंड ट्रुथ और प्रतिकृति सुनिश्चित करता है।

Frank Guo2026-07-17
💻 computer science

AI-Conducted Interviews in Empirical Software Engineering: An Experience Report

यह अनुभव रिपोर्ट यह प्रदर्शित करती है कि एआई-संचालित, स्व-प्रशासित साक्षात्कार लघु, कम जोखिम वाले अनुभवजन्य सॉफ्टवेयर इंजीनियरिंग अध्ययनों के लिए परिचालन रूप से व्यवहार्य हैं और प्रतिभागियों द्वारा अच्छी तरह से स्वीकार किए जाते हैं, हालांकि गहराई, संवेदनशीलता और गोपनीयता की सीमाओं के कारण वे वर्तमान में मानव-नेतृत्व वाले साक्षात्कारों के पूरक उपकरण के रूप में सबसे बेहतर सेवा करते हैं।

Rohit Gheyi, Danyllo Albuquerque, Márcio Ribeiro, Mirko Perkusich2026-07-17
🤖 AI

Beyond Generalist LLMs: Specialist Agentic Systems for Structured Code Workflow Execution

यह शोध पत्र प्रदर्शित करता है कि विशेषज्ञ एजेंटिक प्रणालियाँ (specialist agentic systems) BPMN आरेखों को निष्पादन योग्य वर्कफ़्लो में बदलने के मामले में सामान्यवादी LLMs की तुलना में काफी बेहतर प्रदर्शन करती हैं, जो औद्योगिक अनुप्रयोगों के लिए उच्च सटीकता, दक्षता और विश्वसनीयता प्रदान करते हुए लागत और त्रुटि दरों को भारी रूप से कम करती हैं।

Harris Borman, Herman Wandabwa, Fusun Yu, Sandeepa Kannangara, Justin Liu, Anna Leontjeva, Ritchie Ng2026-07-17
💻 computer science

Predicting Human Visual Attention on Words in Source Code

यह शोध पत्र एक नवीन कम्प्यूटेशनल मॉडल प्रस्तुत करता है जो जावा और सी प्रोग्रामिंग भाषाओं में अनुभवजन्य आई-ट्रैकिंग डेटा के साथ न्यूरल नेटवर्क के आंतरिक ध्यान (इंटरनल अटेंशन) को संरेखित करने के लिए एक विशिष्ट लॉस फंक्शन का उपयोग करके सोर्स कोड पर मानव दृश्य ध्यान की भविष्यवाणी करने में मौजूदा बेसलाइन और उन्नत एआई सिस्टम से काफी बेहतर प्रदर्शन करता है।

Chia-Yi Su, Collin McMillan2026-07-17
💻 computer science

SYNAPSE: A Multi-LLM Orchestrated AI Tutor for Secure Software Development Education with Neurodivergent-First Design

यह शोध पत्र SYNAPSE प्रस्तुत करता है, जो एक न्यूरोडायवर्जेंट-प्रथम (neurodivergent-first), मल्टी-एलएलएम ऑर्केस्ट्रेटेड (multi-LLM orchestrated) एआई ट्यूटरिंग प्लेटफॉर्म है, जो सुरक्षित सॉफ्टवेयर विकास सिखाने के लिए सुकराती संकेत नीति (Socratic hint policy) और एक जानबूझकर असुरक्षित वेब एप्लिकेशन का उपयोग करता है, जो डिटेक्ट-अंडरस्टैंड-रेमेडिएट (detect-understand-remediate) लूप के माध्यम से एक पायलट अध्ययन में उच्च उपयोगिता और जुड़ाव प्रदर्शित करता है।

Giusy Ferrara, Ashkan Sami2026-07-17
🤖 AI

MCPEvol-Bench: Benchmarking LLM Agent Performance Across Dynamic Evolutions of MCP Servers

यह शोध पत्र MCPEvol-Bench का परिचय देता है, जो एक नया बेंचमार्क है जो यथार्थवादी इंटरफ़ेस परिवर्तनों को सिम्युलेट करके MCP सर्वरों में डायनेमिक टूलसेट इवोल्यूशन के प्रति LLM एजेंट की अनुकूलन क्षमता का मूल्यांकन करता है, जिससे यह पता चलता है कि अत्याधुनिक मॉडल भी ऐसे अनुकूलनों के साथ संघर्ष करते हैं और उनके प्रदर्शन में महत्वपूर्ण गिरावट आती है।

Huanxi Liu, Kun Hu, Jiaqi Liao, Qiang Wang, Pengfei Qian, YuanZhao Zhai, Dawei Feng, Bo Ding, Huaimin Wang2026-07-17
🤖 AI

LLM-Driven Approach to Modeling Tool Interoperability in Automotive Domain

यह शोध पत्र एक LLM-संचालित कार्यप्रणाली प्रस्तुत करता है जो मॉडल इंस्टेंस को लक्षित मेटा-मॉडल्स पर मैप करके और मेटा-मॉडल्स को मर्ज करके ऑटोमोटिव डोमेन में मॉडल इंटरऑपरेबिलिटी को स्वचालित करता है, जिससे Ecore और SysML v2 जैसे विषम टूल्स के बीच संरचनात्मक वैधता सुनिश्चित करते हुए मैनुअल ट्रांसफॉर्मेशन प्रयास को काफी कम किया जाता है।

Nenad Petrovic, Jiajie Zhang, Vahid Zolfaghari, Alois Knoll2026-07-17
🤖 AI

Large Language Models for Code Generation from Multilingual Prompts: A Curated Benchmark and a Study on Code Quality

यह शोध पत्र एक क्यूरेटेड बहुभाषी बेंचमार्क प्रस्तुत करता है और एक ऐसा अध्ययन प्रदर्शित करता है जो यह दर्शाता है कि प्रॉम्प्ट में उपयोग की जाने वाली भाषा एलएलएम (LLMs) द्वारा जनरेट किए गए कोड की कार्यात्मक शुद्धता, संरचनात्मक गुणवत्ता और शाब्दिक विशेषताओं को महत्वपूर्ण रूप से प्रभावित करती है, जिससे यह पता चलता है कि अंग्रेजी प्रॉम्प्ट लगातार सर्वोत्तम परिणाम नहीं देते हैं और इसका प्रभाव विभिन्न मॉडलों और प्रोग्रामिंग भाषाओं में भिन्न होता है।

Saima Afrin, Alessandro Midolo, Camilo Escobar-Velásquez, Mario Linares-Vásquez, Weiyuan Ding, Bowen Xu, Massimiliano Di (…)2026-07-17
💻 computer science

Leaf: An Instrumentation-based Dynamic Analysis Framework for Rust

यह शोधपत्र LEAF को प्रस्तुत करता है, जो एक Rust-नेटिव डायनेमिक एनालिसिस फ्रेमवर्क है जो प्रबंधनीय ओवरहेड के साथ विविध विश्लेषण कार्यों का समर्थन करने के लिए एक इवेंट-ड्रिवन इंटरफेस के माध्यम से MIR-स्तरीय सिमेंटिक सूचना और रनटाइम तथ्यों का लाभ उठाता है।

Mohammad Omidvar Tehrani, Marco Gaboardi, Nick Sumner, Steven Y. Ko2026-07-17
💻 computer science

Navigating the Socio-Technical Complexity Challenge in Quantum Software Ecosystems

यह शोध पत्र डिज़ाइन साइंस रिसर्च के माध्यम से विकसित एक सामाजिक-तकनीकी ढांचे को प्रस्तुत करता है ताकि पेशेवरों को "ग्रैविटी वेल्स" (gravity wells) और "सामाजिक-तकनीकी इच्छाओं" (socio-technical desiderata) की अवधारणाओं के माध्यम से परिवेश विकल्पों का मूल्यांकन करके आर्किटेक्चरल लचीलेपन और विकासवादी वृद्धि सुनिश्चित करने हेतु खंडित क्वांटम कंप्यूटिंग परिदृश्य में नेविगेट करने में मदद मिल सके।

Ronja Heikkinen, Santiago Núñez-Corrales, Vlad Stirbu2026-07-17