💻 computer science

Can AI Agents Generate Microservices? How Far are We?

यह शोध पत्र कार्यात्मक माइक्रोसर्विसों को उत्पन्न करने के लिए एआई एजेंटों की क्षमता का मूल्यांकन करता है, जिसमें यह पाया गया है कि हालांकि वे उच्च एपीआई अनुबंध अनुपालन के साथ रखरखाव योग्य कोड का उत्पादन कर सकते हैं—विशेष रूप से क्लीन-स्टेट परिदृश्यों में—निरंतरता में वर्तमान सीमाएं और मानवीय देखरेख की आवश्यकता पूर्णतः स्वायत्त पीढ़ी को रोकती है।

Bassam Adnan, Matteo Esposito, Davide Taibi, Karthik Vaidhyanathan2026-03-11
🤖 AI

The Missing Memory Hierarchy: Demand Paging for LLM Context Windows

यह शोध पत्र पिचाई (Pichay) का परिचय देता है, जो एक डिमांड पेजिंग सिस्टम है जो LLM कॉन्टेक्स्ट विंडोज़ को एक स्टैटिक कैश के बजाय एक मेमोरी पदानुक्रम (मेमोरी हाइरार्की) के रूप में मानता है, और पुराने कंटेंट को हटाने और केवल आवश्यकता होने पर ही उसे डायनेमिक रूप से पुनः लोड करने के माध्यम से प्रोडक्शन में कॉन्टेक्स्ट खपत को 93% तक सफलतापूर्वक कम करता है।

Tony Mason2026-03-11
💻 computer science

The Future of Software Engineering Conferences: A New Zealand Perspective

यह शोध पत्र सॉफ्टवेयर इंजीनियरिंग सम्मेलनों में भाग लेने में न्यूज़ीलैंड के शोधकर्ताओं द्वारा सामना की जाने वाली बाधाओं, जैसे कि उच्च यात्रा लागत और शेड्यूलिंग संबंधी विसंगतियों का परीक्षण करता है, और अधिक न्यायसंगत वैश्विक जुड़ाव को बढ़ावा देने के लिए हाइब्रिड भागीदारी और शासन सुधारों जैसी रणनीतियों का प्रस्ताव करता है।

Kelly Blincoe, Sherlock A. Licorish, Judith Fuchs, Amjed Tahir2026-03-11
💻 computer science

Synergistic Directed Execution and LLM-Driven Analysis for Zero-Day AI-Generated Malware Detection

यह शोध पत्र एक नवीन हाइब्रिड फ्रेमवर्क प्रस्तुत करता है जो ज़ीरो-डे AI-जनरेटेड मैलवेयर का प्रमाणित रूप से सुदृढ़ और अत्यधिक सटीक पता लगाने के लिए कॉनकोलिक निष्पादन (concolic execution), LLM-निर्देशित पथ प्राथमिकता (LLM-guided path prioritization) और डीप लर्निंग को तालमेल के साथ जोड़ता है, जो मानक और संश्लेषित (synthesized) थ्रेट बेंचमार्क दोनों पर पारंपरिक बेसलाइन की तुलना में काफी बेहतर प्रदर्शन करता है।

George Edwards, Mahdi Eslamimehr2026-03-11
💻 computer science

ToolRosetta: Bridging Open-Source Repositories and Large Language Model Agents through Automated Tool Standardization

ToolRosetta एक एकीकृत ढांचा है जो विषम ओपन-सोर्स कोड रिपॉजिटरीज़ को स्वचालित रूप से मानकीकृत, सुरक्षित और निष्पादन योग्य मॉडल कॉन्टेक्स्ट प्रोटोकॉल (MCP) टूल्स में परिवर्तित करता है, जिससे LLM एजेंटों को न्यूनतम मानवीय हस्तक्षेप के साथ जटिल कार्यों के लिए विशेष सॉफ़्टवेयर की स्वायत्त रूप से योजना बनाने और उन्हें कॉल करने में सक्षम बनाया जा सके।

Shimin Di, Xujie Yuan, Hanghui Guo, Chaoqian Ouyang, Zhangze Chen, Ling Yue, Libin Zheng, Jia Zhu, Shaowu Pan, Jian Yin (…)2026-03-11
💻 computer science

EmbC-Test: How to Speed Up Embedded Software Testing Using LLMs and RAG

यह शोधपत्र EmbC-Test प्रस्तुत करता है, जो एक रिट्रीवल-ऑगमेंटेड जनरेशन (RAG) पाइपलाइन है जो बड़े भाषा मॉडलों (LLMs) को प्रोजेक्ट-विशिष्ट आर्टिफैक्ट्स के माध्यम से ग्राउंड करने के लिए उनका उपयोग करती है, जिससे सिंटैक्टिक रूप से सही और रनटाइम-वैलिड एम्बेडेड सी टेस्ट का स्वचालित निर्माण सक्षम होता है जो परीक्षण समय को 66% तक कम करता है और प्रति घंटा 270 टेस्ट उत्पन्न करता है।

Maximilian Harnot, Sebastian Komarnicki, Michal Polok, Timo Oksanen2026-03-11
🤖 AI

EsoLang-Bench: Evaluating Genuine Reasoning in Large Language Models via Esoteric Programming Languages

यह शोधपत्र EsoLang-Bench को प्रस्तुत करता है, जो एक नवीन बेंचमार्क है जो बड़े भाषा मॉडलों (large language models) की वास्तविक तर्क क्षमताओं की सीमाओं को उजागर करने के लिए गूढ़ प्रोग्रामिंग भाषाओं (esoteric programming languages) का उपयोग करता है, जिससे उनके मानक बेंचमार्क पर उच्च स्कोर और दस्तावेज़ीकरण एवं प्रयोग के माध्यम से नई भाषाओं को सीखने के बजाय केवल याद रखने (memorization) पर आधारित कार्यों में शून्य के करीब सटीकता के बीच के नाटकीय अंतर का पता चलता है।

Aman Sharma, Paras Chopra2026-03-11
🤖 AI

LAMBDA: A Large Model Based Data Agent

लैम्ब्डा (LAMBDA) एक नवीन, ओपन-सोर्स, कोड-मुक्त मल्टी-एजेंट सिस्टम है जो विविध उपयोगकर्ताओं के लिए डेटा विश्लेषण की सुलभता और दक्षता को बढ़ाने हेतु प्रोग्रामर और इंस्पेक्टर की सहयोगात्मक भूमिकाओं के साथ बड़े भाषा मॉडलों (लार्ज लैंग्वेज मॉडल्स), एक ज्ञान एकीकरण तंत्र और उपयोगकर्ता हस्तक्षेप क्षमताओं का लाभ उठाता है।

Maojun Sun, Ruijian Han, Binyan Jiang, Houduo Qi, Defeng Sun, Yancheng Yuan, Jian Huang2026-03-10
💻 computer science

The Future of Software Testing: AI-Powered Test Case Generation and Validation

यह शोध पत्र इस बात का अन्वेषण करता है कि कैसे सॉफ्टवेयर परीक्षण में आर्टिफिशियल इंटेलिजेंस को एकीकृत करना डेटा गुणवत्ता, मॉडल पारदर्शिता और स्वचालन एवं मानवीय निरीक्षण के बीच संतुलन से संबंधित चुनौतियों का समाधान करते हुए दक्षता, सटीकता और मापनीयता को बढ़ाकर टेस्ट केस के निर्माण और सत्यापन को रूपांतरित करता है।

Mohammad Baqar, Rajat Khanda2026-03-10
💻 computer science

Taint Analysis for Graph APIs Focusing on Broken Access Control

यह शोध पत्र एक नवीन हाइब्रिड दृष्टिकोण प्रस्तुत करता है जो ग्राफ एपीआई (Graph APIs) में प्रत्यक्ष और अप्रत्यक्ष दोनों प्रकार के टूटे हुए एक्सेस कंट्रोल (broken access control) भेद्यताओं को व्यवस्थित रूप से खोजने के लिए स्टैटिक ग्राफ ट्रांसफॉर्मेशन-आधारित टेइंट विश्लेषण (taint analysis) को डायनेमिक वेरिफिकेशन के साथ जोड़ता है, जैसा कि GitHub GraphQL API पर इसके अनुप्रयोग के माध्यम से प्रदर्शित किया गया है।

Leen Lambers, Lucas Sakizloglou, Taisiya Khakharova, Fernando Orejas2026-03-10