💻 computer science

Faster Code, Deeper Debt? A Multivocal Literature Review on Technical Debt and Its Early Signs in LLM-Assisted Software Development

104 स्रोतों का यह बहुस्वरतापूर्ण (multivocal) साहित्य समीक्षा प्रकट करती है कि LLM-सहायता प्राप्त सॉफ्टवेयर विकास पारंपरिक तकनीकी ऋण (technical debt) को बढ़ाता है और प्रॉम्प्ट (prompt) तथा स्रोत (provenance) ऋण जैसी नई LLM-विशिष्ट श्रेणियों को पेश करता है, जो त्वरित कोडिंग और दीर्घकालिक रखरखाव लागतों के बीच संतुलन प्रबंधित करने के लिए मानकीकृत मेट्रिक्स और शमन रणनीतियों की तत्काल आवश्यकता को रेखांकित करता है।

Ramtin Ehsani, Shriya Rawal, Yuanfang Cai, Preetha Chatterjee2026-06-16
💻 computer science

Knowledge-Based Zero-Replay Debugging of Multi-Agent LLM Traces

यह शोधपत्र मल्टी-एजेंट एलएलएम (LLM) प्रणालियों के लिए एक लागत-कुशल, ज़ीरो-रिप्ले (zero-replay) डिबगिंग फ्रेमवर्क पेश करता है जो निष्पादन ट्रेस (execution traces) को संरचित ज्ञान ग्राफों में संकलित करता है और 93% रिकॉल के साथ उच्च-प्रभाव वाले कारण संबंधी घटनाओं (causal events) की पहचान करने के लिए एक कैलिब्रेटेड लर्निंग-टू-रैंक प्रेडिक्टर का उपयोग करता है, जिससे व्यापक काउंटरफैक्चुअल रिप्ले (counterfactual replays) की रैखिक लागत समाप्त हो जाती है।

Dong Ho Kang, Hyeonjeong Cha, Daein Weon2026-06-16
💻 computer science

Pandas for Reproducible Data Analysis: From Spreadsheets to Research-Grade Python Workflows

यह शोध पत्र स्प्रेडशीट-प्रधान, मैनुअल विश्लेषणात्मक वर्कफ़्लो को हितधारकों के लिए एक्सेल जैसे परिचित इंटरफ़ेस को बनाए रखते हुए, पुनरुत्पादनीय, ऑडिट करने योग्य और अनुसंधान-ग्रेड प्रक्रियाओं में बदलने के लिए पायथन पांडास (pandas) लाइब्रेरी का एक व्यावहारिक सेतु के रूप में उपयोग करने की वकालत करता है।

Sidney Shapiro, Daniel Pearson, Emiliano Sebastian Gonzalez Venegas2026-06-16
💻 computer science

Specifications for Humans, Agents, and Tooling

यह टूल पेपर बोस्के एपीआई (BAPI) इकोसिस्टम का परिचय देता है, जो एक पॉलीग्लॉट स्पेसिफिकेशन लैंग्वेज है जिसे स्पष्ट, सुस्पष्ट और विश्वसनीय स्पेसिफिकेशन के माध्यम से सॉफ्टवेयर विकास को बढ़ाने के लिए डिज़ाइन किया गया है जो एजेंटिक एआई सिस्टम के लिए टेस्ट जनरेशन, वैलिडेशन और सुरक्षा सहित पूर्ण एप्लिकेशन लाइफसाइकिल का समर्थन करता है।

Mark Marron2026-06-16
💻 computer science

The Hitchhiker's Guide to Program Analysis, Part III: Mostly Harmless LLMs

यह शोध पत्र एविडेंट (Evident) प्रस्तुत करता है, जो एक बग विश्लेषण प्रणाली है जो विशेष रूप से निष्पादन-विशिष्ट विश्लेषण हार्नेस (execution-specific analysis harnesses) बनाने के लिए एलएलएम (LLMs) का लाभ उठाती है और यह कड़ाई से निर्धारित करने के लिए औपचारिक बैकएंड सत्यापन (formal backend verification) पर निर्भर करती है कि रिपोर्ट की गई त्रुटियां सुलभ (reachable) हैं या नहीं, जिससे पुष्टि की गई कमजोरियों को छोड़े बिना झूठी चेतावनियों को दूर करने में उच्च सटीकता प्राप्त होती है।

Haonan Li, Tianyang Zhou, Manu Sridharan, Hang Zhang, Zhiyun Qian2026-06-16
💻 computer science

AI-driven Software Development: A Pragmatic Path to Agentic Development Processes

यह शोधपत्र सहायक एआई (AI) उपकरणों से नियंत्रित एजेंटिक विकास प्रक्रियाओं की ओर संक्रमण के लिए एक व्यावहारिक ढांचे का प्रस्ताव करता है, जो सॉफ्टवेयर विकास जीवनचक्र में एआई को समाहित करने के लिए आवश्यक तकनीकी, संगठनात्मक और शासन तंत्रों—विशेष रूप से संदर्भ, सत्यापन और मानव निरीक्षण के लिए एक केंद्रीय "हारनेस" (harness)—पर बल देता है, जिसे एक मध्यम आकार की कंपनी के केस स्टडी के माध्यम से सत्यापित किया गया है।

Peter Mandl, Paul Mandl2026-06-16
💻 computer science

A Scalability Analysis of Quantitative Confidence Assessment Methods for Assurance Cases

यह शोध पत्र एश्योरेंस केसेस (assurance cases) पर मात्रात्मक विश्वास मूल्यांकन विधियों को लागू करने की निर्णय जटिलता और प्रयास का अनुमान लगाने के लिए एक मॉडल प्रस्तुत करता है, जो बेयसियन बिलीफ नेटवर्क (Bayesian Belief Network), डेम्पस्टर-शाफ़र थ्योरी (Dempster-Shafer Theory) और सर्टस (Certus) विधियों के विश्लेषण के माध्यम से यह प्रदर्शित करता है कि हालांकि सर्टस की वर्स्ट-केस (worst-case) जटिलता उच्चतम है, लेकिन इसमें अन्य दोनों दृष्टिकोणों की तुलना में औसत-केस (average-case) प्रयास कम लगता है।

Simon Diemert, Jens H. Weber2026-06-16
🤖 AI

Your Agent Has a Genome: Sequence-Level Behavioral Analysis and Runtime Governance of LLM-Powered Autonomous Agents

यह शोध पत्र "बेस सीक्वेंस एनालिसिस" (Base Sequence Analysis) प्रस्तुत करता है, जो एक जीनोमिक-प्रेरित ढांचा है जो उच्च-जोखिम वाले पैटर्न और सत्यापन संबंधी कमियों की पहचान करने के लिए LLM एजेंट व्यवहारों को प्रतीकात्मक अनुक्रमों (symbolic sequences) में एनकोड करता है, जिससे "गवर्नर" (Governor) का विकास होता है, जो एक रनटाइम गवर्नेंस सिस्टम है जो स्वायत्त एजेंटों में कार्य सफलता दर में उल्लेखनीय सुधार करता है और टोकन खपत को कम करता है।

Sidi Deng2026-06-16✓ Author reviewed
💻 computer science

Teaching testing seriously in academia

यह स्थिति पत्र (position paper) तर्क देता है कि सॉफ्टवेयर परीक्षण शिक्षा को एक तर्कवादी, निर्देशात्मक प्रतिमान से बदलकर एक अनुभवजन्य, अन्वेषण-संचालित दृष्टिकोण की ओर स्थानांतरित होना चाहिए, जो P4TEST ढांचे और 4C/ID अनुदेशात्मक मॉडल का प्रस्ताव करता है ताकि छात्रों को जटिल, AI-एकीकृत प्रणालियों के लिए आवश्यक महत्वपूर्ण तर्क कौशल से बेहतर रूप से सुसज्जित किया जा सके।

Tanja E. J. Vos, Bart Th. Knaack, Beatriz Marín, Niels Doorn, Nikè van Vugt-Hage2026-06-16