🤖 AI

From Prompt to Process: a Process Taxonomy and Comparative Assessment of Frameworks Supporting AI Software Development Agents

यह शोध पत्र छह उभरते हुए एआई सॉफ्टवेयर विकास ढांचों का तुलनात्मक रूप से आकलन करने के लिए एक छह-आयामी प्रक्रिया वर्गीकरण और स्कोरिंग रूब्रिक प्रस्तुत करता है, जो निरंतर आर्टिफैक्ट्स और मानव समीक्षा की ओर अभिसरण को प्रकट करते हुए प्रक्रिया की गहराई और पोर्टेबिलिटी के बीच एक संरचनात्मक समझौते के साथ-साथ स्पेसिफिकेशन ड्रिफ्ट और प्लेटफॉर्म निर्भरता जैसे महत्वपूर्ण जोखिमों को उजागर करता है।

Sanderson Oliveira de Macedo2026-06-04
💻 computer science

How Software Engineering Students Use LLMs to Write Research Papers: An Experience Report

यह अनुभव रिपोर्ट एक तीसरे वर्ष के सॉफ्टवेयर आर्किटेक्चर पाठ्यक्रम के 146 छात्र प्रकटीकरण कथनों (डिस्क्लोजर स्टेटमेंट्स) का विश्लेषण करती है ताकि यह दर्शाया जा सके कि छात्र मंथन (ब्रेनस्टॉर्मिंग) और लेखन जैसे कार्यों के लिए अनुभवजन्य अनुसंधान असाइनमेंट में लार्ज लैंग्वेज मॉडल्स को कैसे एकीकृत करते हैं, साथ ही सामग्री की सटीकता और सत्यापन के संबंध में उनकी चिंताओं को भी उजागर करती है।

Ronnie de Souza Santos, Maria Teresa Baldassarre, Cleyton Magalhaes, Italo Santos2026-06-04
💻 computer science

A Conceptual Model and Methodology for Sustainability-aware, IoT-enhanced Business Processes

यह शोध पत्र एक वैचारिक मॉडल और संरचित कार्यप्रणाली प्रस्तावित करता है ताकि व्यावसायिक प्रक्रियाओं में IoT क्षमताओं को व्यवस्थित रूप से एकीकृत किया जा सके, जिससे पर्यटन और स्वास्थ्य सेवा के केस स्टडीज के माध्यम से प्रदर्शित पर्यावरणीय, सामाजिक और आर्थिक आयामों में स्थिरता के मापन और सुधार को सक्षम बनाया जा सके।

Victoria Torres Bosch, Ronny Seiger, Manuela Albert Albiol, Antoni Mestre Gascon, Pedro Jose Valderas Aranda2026-06-03
🤖 AI

CodeHacker: Automated Test Case Generation for Detecting Vulnerabilities in Competitive Programming Solutions

CodeHacker एक स्वचालित एजेंट फ्रेमवर्क है जो लक्षित प्रतिकूल परीक्षण मामले (adversarial test cases) उत्पन्न करने के लिए एक बहु-रणनीति दृष्टिकोण और एक स्व-अंशांकन चरण (self-calibration phase) को नियोजित करके कोड जनरेशन मॉडल्स के मूल्यांकन को बढ़ाता है, जो प्रतिस्पर्धी प्रोग्रामिंग समाधानों में कमजोरियों को प्रभावी ढंग से उजागर करता है और बेंचमार्क डेटासेट एवं RL-प्रशिक्षित मॉडल्स दोनों की मजबूती में सुधार करता है।

Jingwei Shi, Xinxiang Yin, Jing Huang, Jinman Zhao, Shengyu Tao2026-06-03
💻 computer science

From Rocq to Metal: A Pipeline for Formally Verified Microcontroller Firmware

यह शोध पत्र Encore! प्रस्तुत करता है, जो एक बेयर-मेटल कंटिन्यूएशन पासिंग स्टाइल (Continuation Passing Style) वर्चुअल मशीन है, जो कोर को एक प्रुवेबल स्टेट-ट्रांजिशन फंक्शन के रूप में संरचित करके माइक्रोकंट्रोलर्स पर औपचारिक रूप से सत्यापित, रॉक (Rocq) द्वारा एक्सट्रैक्ट किए गए स्कीम (Scheme) फर्मवेयर के निष्पादन को सक्षम बनाता है, जिससे मशीन-चेक्ड गारंटी के साथ सुरक्षा-महत्वपूर्ण कोड के एआई-सहायता प्राप्त जनरेशन को सुगम बनाया जा सके।

Valentin Bergeron, Karolina Gorna2026-06-03
💻 computer science

Acceptance-Test-Driven Evaluation Protocols for Business-Centric LLM Systems

यह शोध पत्र एक स्वीकृति-परीक्षण-संचालित मूल्यांकन ढांचे का प्रस्ताव करता है जो हितधारकों के लक्ष्यों को निष्पादन योग्य व्यवहारिक अनुबंधों और एक "रेड-ट्रैफ़िक-ग्रीन" जीवनचक्र में अनुवादित करके संभाव्य (probabilistic) एलएलएम क्षमताओं और नियतात्मक (deterministic) व्यावसायिक आवश्यकताओं के बीच के अंतर को पाटता है ताकि सुरक्षित, विश्वसनीय और आर्थिक रूप से उपयोगी एआई प्रणालियों को सुनिश्चित किया जा सके।

Eric Liang2026-06-03
💻 computer science

Report on the Designing Accountable Software Systems Workshop

अमेरिकी राष्ट्रीय विज्ञान फाउंडेशन द्वारा समर्थित, नवंबर 2024 में आयोजित 'डिज़ाइनिंग अकाउंटेबल सॉफ्टवेयर सिस्टम्स' (DASS) कार्यशाला ने सॉफ्टवेयर जवाबदेही के आयामों, कानूनी ढांचों और परिचालन चुनौतियों का पता लगाने के लिए अंतर-विषयक हितधारकों को एकत्रित किया, जिसने अंततः जिम्मेदारियों को स्पष्ट करने, सॉफ्टवेयर डिज़ाइन में जवाबदेही के एकीकरण में सुधार करने और अंतर-विषयक सहयोग की अनूठी मांगों को संबोधित करने के लिए प्रमुख अनुसंधान दिशाओं की पहचान की।

Catherine Albiston, Travis Breaux, Kat Dearstyne, Jane Cleland-Huang, Serge Egelman, Joan Feigenbaum, Lu Feng, Max Lindq (…)2026-06-03
💻 computer science

SPOQ: Specialist Orchestrated Queuing for Multi-Agent Software Engineering

SPOQ एक नवीन मल्टी-एजेंट सॉफ्टवेयर इंजीनियरिंग कार्यप्रणाली है जो वेव-आधारित टोपोलॉजिकल डिस्पैच, डुअल वैलिडेशन गेट्स और ह्यूमन-इन-द-लूप ओवरसाइट को एकीकृत करती है ताकि विविध रिपॉजिटरीज़ में उच्च कोड गुणवत्ता बनाए रखते हुए दोषों को महत्वपूर्ण रूप से कम किया जा सके, प्लानिंग साइकल को समाप्त किया जा सके और पर्याप्त गति प्राप्त की जा सके।

Royce Carbowitz, Dheeraj Kumar2026-06-03✓ Author reviewed
💻 computer science

Human-AI Collaboration and the Transformation of Software Engineering Work

यह शोध पत्र इस बात के साक्ष्यों का संश्लेषण करता है कि कैसे जनरेटिव और एजेंटिक एआई (Generative and Agentic AI) सॉफ्टवेयर इंजीनियरिंग को कोड लेखन से मानव-एआई सहयोग और शासन की ओर रूपांतरित कर रहे हैं, जो भविष्य के कार्यबल, शिक्षा और संगठनात्मक अनुकूलन के मार्गदर्शन के लिए एक नया सक्षमता ढांचा और नौ प्रस्ताव प्रस्तावित करता है।

Mamdouh Alenezi2026-06-03
💻 computer science

Can AI be Easy? Lessons Learned from the EZR.py Toolkit

यह शोध पत्र तर्क देता है कि एक न्यूनतम, एकीकृत पायथन टूलकिट (EZR.py) बनाने के लिए कोड को पढ़ने और रिफैक्टर करने से यह पता चलता है कि सरल, हल्के एल्गोरिदम जटिल अत्याधुनिक उपकरणों की तुलना में बेहतर प्रदर्शन कर सकते हैं, जबकि उन्हें काफी कम डेटा और गणना संसाधनों की आवश्यकता होती है।

Tim Menzies, Srinath Srinivasan2026-06-03✓ Author reviewed