🤖 AI

ReqFusion: A Multi-Provider Framework for Automated PEGS Analysis Across Software Domains

यह शोध पत्र ReqFusion को प्रस्तुत करता है, जो एक AI-संवर्धित मल्टी-प्रदाता ढांचा है जो सॉफ्टवेयर आवश्यकताओं के निष्कर्षण और वर्गीकरण को स्वचालित करने के लिए कई लार्ज लैंग्वेज मॉडल्स (LLMs) और एक डोमेन-स्वतंत्र PEGS-आधारित प्रॉम्पटिंग रणनीति का लाभ उठाता है, जिससे मैन्युअल तरीकों और जेनेरिक प्रॉम्पटिंग दृष्टिकोणों की तुलना में उच्च सटीकता प्राप्त होती है और विश्लेषण समय में महत्वपूर्ण कमी आती है।

Muhammad Khalid, Manuel Oriol, Yilmaz Uygun2026-03-25
💻 computer science

Robotics Meets Software Engineering: A First Look at the Robotics Discussions on Stackoverflow

यह सहयोगात्मक अध्ययन प्रचलित विकास चुनौतियों की पहचान करने के लिए स्टैकओवरफ्लो (StackOverflow) पर रोबोटिक्स से संबंधित 500 प्रश्नों का विश्लेषण करता है, जिससे यह पता चलता है कि जहाँ समुदाय दृश्यता संबंधी समस्याओं और "कैसे करें" (how-to) संबंधी पूछताछ की प्रधानता का सामना करता है, वहीं रोबोट मूवमेंट जैसे विशिष्ट विषय समय के साथ चर्चाओं पर लगातार हावी रहते हैं।

Hisham Kidwai, Danika Passler Bates, Sujana Islam Suhi, Md Nahidul Islam Opu, James Young, Shaiful Chowdhury2026-03-24
💻 computer science

How Software Engineers Engage with AI: A Pragmatic Workflow

यह शोधपत्र तुर्की और अज़रबैजान में ग्रे लिटरेचर (grey literature) और क्षेत्रीय अवलोकनों से व्युत्पन्न एक व्यावहारिक वर्कफ़्लो और एक चार-चतुर्थांश निर्णय मॉडल प्रस्तुत करता है, जो सॉफ्टवेयर इंजीनियरों को उनके दैनिक कार्यों में एआई-जनित आर्टिफ़ेक्ट्स (AI-generated artifacts) के विश्वास, परिशोधन और मैनुअल फॉलबैक (manual fallback) को प्रभावी ढंग से नेविगेट करने में मार्गदर्शन करने के लिए है।

Vahid Garousi, Zafar Jafarov, Aytan Mövsümova, Atif Namazov2026-03-24
💬 NLP

Automatically Benchmarking LLM Code Agents through Agent-Driven Annotation and Evaluation

यह शोध पत्र PRDBench प्रस्तुत करता है, जो संरचित आवश्यकताओं वाले 50 वास्तविक-विश्व पायथन प्रोजेक्ट्स का एक स्केलेबल बेंचमार्क है, और PRDJudge, जो एक विशेष रूप से फाइन-ट्यून किया गया मूल्यांकन मॉडल है जो 90% से अधिक मानव संरेखण (human alignment) प्राप्त करता है, जो सामूहिक रूप से मौजूदा कोड एजेंट बेंचमार्क की उच्च एनोटेशन लागत और मूल्यांकन संबंधी अशुद्धियों को संबोधित करता है।

Lingyue Fu, Bolun Zhang, Hao Guan, Yaoming Zhu, Lin Qiu, Weiwen Liu, Xuezhi Cao, Xunliang Cai, Weinan Zhang, Yong Yu2026-03-24
💻 computer science

A survey of generative AI adoption and perceived productivity among scientists who program

868 वैज्ञानिक प्रोग्रामरों के एक सर्वेक्षण से पता चलता है कि जबकि जनरेटिव एआई (generative AI) को अपनाने की दर कम अनुभवी उपयोगकर्ताओं में सर्वाधिक है जो सामान्य प्रयोजन वाले उपकरणों को प्राथमिकता देते हैं, कथित उत्पादकता वास्तविक सत्यापन के बजाय स्वीकृत जनरेटेड कोड की मात्रा और औपचारिक विकास प्रथाओं की कमी से प्रेरित है, जो अत्यधिक निर्भरता के एक संभावित जोखिम को उजागर करती है।

Gabrielle O'Brien, Alexis Parker, Nasir Eisty, Jeffrey Carver2026-03-24
🤖 AI

Hybrid-Code v2: Zero-Hallucination Clinical ICD-10 Coding via Neuro-Symbolic Verification and Automated Knowledge Base Expansion

हाइब्रिड-कोड v2 एक न्यूरो-सिंबोलिक फ्रेमवर्क है जो न्यूरल कैंडिडेट जनरेशन को एक सिंबोलिक वेरिफिकेशन लेयर और ऑटोमेटेड नॉलेज बेस एक्सपेंशन के साथ एकीकृत करके क्लिनिकल ICD-10 कोडिंग में ज़ीरो टाइप-I हैलुसिनेशन प्राप्त करता है, जिससे यह विशुद्ध रूप से न्यूरल दृष्टिकोणों के सुरक्षा जोखिमों के बिना उच्च परिशुद्धता और कवरेज प्रदान करता है।

Yunguo Yu2026-03-24
🤖 machine learning

On Randomness in Agentic Evals

यह शोध पत्र प्रदर्शित करता है कि एजेंटिक प्रणालियों (agentic systems) के एकल-रन मूल्यांकन प्रारंभिक प्रक्षेपवक्र विचलन (early trajectory divergence) के कारण पर्याप्त विचलन से ग्रस्त होते हैं, और यह तर्क देता है कि वास्तविक प्रगति के विश्वसनीय मूल्यांकन के लिए वास्तविक एल्गोरिद्मिक सुधारों को मूल्यांकन शोर (evaluation noise) से अलग करने हेतु कई रन, सांख्यिकीय शक्ति विश्लेषण (statistical power analysis) और व्यापक प्रदर्शन मेट्रिक्स की आवश्यकता है।

Bjarni Haukur Bjarnason, André Silva, Martin Monperrus2026-03-24
💻 computer science

Configuring Agentic AI Coding Tools: An Exploratory Study

यह शोध पत्र 2,923 GitHub रिपॉजिटरीज़ में एजेंटिक AI कोडिंग टूल्स के लिए कॉन्फ़िगरेशन तंत्रों का एक व्यवस्थित विश्लेषण और अनुभवजन्य अध्ययन प्रस्तुत करता है, जो यह प्रकट करता है कि जहाँ AGENTS.md जैसी स्थिर संदर्भ फ़ाइलें (static context files) अपनाने में हावी हैं, वहीं स्किल्स (Skills) और सब-एजेंट्स (Subagents) जैसी उन्नत सुविधाएँ कम उपयोग की जाती हैं, जिससे विशिष्ट टूल-विशिष्ट कॉन्फ़िगरेशन संस्कृतियाँ उभरती हैं।

Matthias Galster, Seyedmoein Mohsenimofidi, Jai Lal Lulla, Muhammad Auwal Abubakar, Christoph Treude, Sebastian Baltes2026-03-24
💻 computer science

From Human Interfaces to Agent Interfaces: Rethinking Software Design in the Age of AI-Native Systems

यह शोध पत्र तर्क देता है कि LLM-आधारित एजेंटों का उदय सॉफ्टवेयर इंजीनियरिंग में मानव-केंद्रित ग्राफिकल इंटरफेस से हटकर आह्वान योग्य क्षमताओं (invocable capabilities) पर निर्मित एजेंट-उन्मुख प्रणालियों की ओर एक प्रतिमान परिवर्तन (paradigm shift) को आवश्यक बनाता है, जो गतिशील, AI-संचालित सॉफ्टवेयर आह्वान को सक्षम करने के लिए मशीन व्याख्यात्मकता, संयोजकता और विश्वसनीयता पर बल देता है।

Shaolin Wang, Yi Mei, Haoyang Che, He Jiang, Shui Yu, Ying Gu2026-03-24
💻 computer science

kRAIG: A Natural Language-Driven Agent for Automated DataOps Pipeline Generation

यह शोध पत्र kRAIG को प्रस्तुत करता है, जो एक ऐसा AI एजेंट है जो उपयोगकर्ता के इरादे को स्पष्ट करने के लिए ReQuesAct फ्रेमवर्क, डेटा ट्रांसफॉर्मेशन के लिए रिट्रीवल-ऑगमेंटेड टूल सिंथेसिस, और पाइपलाइन की विश्वसनीयता एवं सटीकता सुनिश्चित करने के लिए LLM-आधारित वैलिडेशन का उपयोग करके प्राकृतिक भाषा से प्रोडक्शन-रेडी Kubeflow Pipelines के निर्माण को स्वचालित करता है।

Rohan Siva, Kai Cheung, Lichi Li, Ganesh Sundaram2026-03-24