💻 computer science

When is Generated Code Difficult to Comprehend? Assessing AI Agent Python Code Proficiency in the Wild

यह अध्ययन AI-जनित पुल रिक्वेस्ट (pull requests) से 5,027 पायथन फाइलों का विश्लेषण करता है और पाता है कि जबकि AI एजेंट मुख्य रूप से मानव आउटपुट के समान बुनियादी स्तर का कोड उत्पन्न करते हैं, विशिष्ट जटिल कार्यों के लिए प्रभावी समीक्षा और रखरखाव हेतु अभी भी उन्नत डेवलपर दक्षता की आवश्यकता होती है।

Nanthit Temkulkiat, Chaiyong Ragkhitwetsagul, Morakot Choetkiertikul, Ruksit Rojpaisarnkit, Raula Gaikovina Kula2026-04-02
🤖 AI

EvolveTool-Bench: Evaluating the Quality of LLM-Generated Tool Libraries as Software Artifacts

यह शोध पत्र EvolveTool-Bench को प्रस्तुत करता है, जो एक नैदानिक बेंचमार्क है जो पुन: उपयोग (reuse), अतिरेक (redundancy) और सुरक्षा जैसे मेट्रिक्स के माध्यम से LLM-जनित टूल लाइब्रेरीज़ की सॉफ्टवेयर गुणवत्ता का मूल्यांकन करता है, जो उन प्रणालियों के बीच महत्वपूर्ण स्वास्थ्य असमानताओं को प्रकट करता है जो केवल कार्य पूर्णता दरों (task completion rates) के आधार पर समान दिखाई देती हैं।

Alibek T. Kaliyev, Artem Maryanskyy2026-04-02
💻 computer science

Programming by Chat: A Large-Scale Behavioral Analysis of 11,579 Real-World AI-Assisted IDE Sessions

यह शोध पत्र 11,579 वास्तविक दुनिया के AI-सहायता प्राप्त IDE सत्रों का पहला बड़े पैमाने पर अनुभवजन्य अध्ययन प्रस्तुत करता है, जो यह प्रकट करता है कि कैसे संवादात्मक प्रोग्रामिंग डेवलपर वर्कफ़्लो को पुनरावृत्ति विनिर्देश (iterative specification), AI को संज्ञानात्मक प्रतिनिधिमंडल (cognitive delegation) और सक्रिय सहयोग प्रबंधन की ओर स्थानांतरित करती है।

Ningzhi Tang, Chaoran Chen, Zihan Fang, Gelei Xu, Maria Dhakal, Yiyu Shi, Collin McMillan, Yu Huang, Toby Jia-Jun Li2026-04-02
🤖 AI

Executing as You Generate: Hiding Execution Latency in LLM Code Generation

यह शोध पत्र "Eager" को प्रस्तुत करता है, जो एक समानांतर निष्पादन ढांचा (parallel execution framework) है जो खाली समय (idle time) को समाप्त करने के लिए कोड जनरेशन और निष्पादन को ओवरलैप करता है, जिससे कई बेंचमार्क और मॉडलों में गैर-ओवरलैप्ड विलंबता (non-overlapped latency) में 99.9% तक की कमी और एंड-टू-एंड प्रदर्शन में 55% तक की तेजी आती है।

Zhensu Sun, Zhihao Lin, Zhi Chen, Chengran Yang, Mingyi Zhou, Li Li, David Lo2026-04-02
🤖 AI

Ontology-Constrained Neural Reasoning in Enterprise Agentic Systems: A Neurosymbolic Architecture for Domain-Grounded AI Agents

यह शोध पत्र फाउंडेशन एजेंटिकओएस (Foundation AgenticOS) प्लेटफॉर्म के भीतर एक न्यूरोसिम्बोलिक आर्किटेक्चर प्रस्तुत करता है जो बड़े भाषा मॉडल (LLM) एजेंटों को नियंत्रित करने के लिए एक त्रि-स्तरीय ऑन्टोलॉजिकल ढांचे का उपयोग करता है, जो इनपुट और आउटपुट दोनों पर औपचारिक सिमेंटिक ग्राउंडिंग को लागू करके उनकी सटीकता, नियामक अनुपालन और भूमिका निरंतरता में महत्वपूर्ण सुधार करता है—विशेष रूप से सीमित प्रशिक्षण डेटा वाले डोमेन में।

Thanh Luong Tuan2026-04-02
⚛️ quantum physics

Quantum-Safe Code Auditing: LLM-Assisted Static Analysis and Quantum-Aware Risk Scoring for Post-Quantum Cryptography Migration

यह शोध पत्र "क्वांटम-सेफ कोड ऑडिटर" (Quantum-Safe Code Auditor) को प्रस्तुत करता है, जो एक ओपन-सोर्स फ्रेमवर्क है जो पोस्ट-क्वांटम माइग्रेशन से पहले सॉफ्टवेयर में क्रिप्टोग्राफिक कमजोरियों की पहचान और प्राथमिकता निर्धारण को स्वचालित करने के लिए रेगुलर एक्सप्रेशन (regex)-आधारित डिटेक्शन, एलएलएम (LLM)-सहायता प्राप्त प्रासंगिक विश्लेषण, और एक किस्किटट (Qiskit)-आधारित वेरिएशनल क्वांटम आइजनसोल्वर (Variational Quantum Eigensolver) रिस्क स्कोरिंग मॉडल को संयोजित करता है, जो पांच प्रमुख लाइब्रेरीज़ में उच्च परिशुद्धता (precision) और रिकॉल (recall) प्राप्त करता है।

Animesh Shaw2026-04-02
💻 computer science

LibScan: Smart Contract Library Misuse Detection with Iterative Feedback and Static Verification

यह शोध पत्र LibScan प्रस्तुत करता है, जो एक स्वचालित ढांचा है जो स्मार्ट कॉन्ट्रैक्ट लाइब्रेरी के दुरुपयोग की आठ श्रेणियों का प्रभावी ढंग से पता लगाने के लिए लार्ज लैंग्वेज मॉडल-आधारित सिमेंटिक रीजनिंग को नियम-आधारित स्टैटिक एनालिसिस और एक इटरेटिव सेल्फ-करेक्शन मैकेनिज्म के साथ जोड़ता है, जिससे वास्तविक दुनिया के कॉन्ट्रैक्ट्स पर 85.15% सटीकता प्राप्त होती है और मौजूदा टूल्स की तुलना में काफी बेहतर प्रदर्शन होता है।

Yishun Wang, Wenkai Li, Xiaoqi Li, Zongwei Li, Lei Xie, Yuqing Zhang2026-04-02
💻 computer science

Detecting Call Graph Unsoundness without Ground Truth

यह शोधपत्र एक बड़े पैमाने का अनुभवजन्य अध्ययन प्रस्तुत करता है जो यह प्रदर्शित करता है कि जावा स्टैटिक एनालिसिस फ्रेमवर्क्स में मोनोटोनिक प्रिसिजन (monotonic precision) की सामान्य धारणा आधुनिक भाषा संबंधी विशेषताओं, कॉन्फ़िगरेशन इंटरैक्शन और उपकरणों के बीच अप्राप्य सिमेंटिक अंतराल के कारण मौलिक रूप से त्रुटिपूर्ण है, जिससे वर्तमान मूल्यांकन पद्धतियों को चुनौती मिलती है और एल्गोरिदम, कॉन्फ़िगरेशन एवं फ्रेमवर्क सिमेंटिक्स के बारे में संयुक्त तर्कसंगत विचार की आवश्यकता पर बल मिलता है।

Fangtian Zhong, Ollie Wold, Joseph Windmann2026-04-02
💻 computer science

Portable and Secure CI/CD for COBOL: Lessons from an Industrial Migration

यह शोध पत्र बैंकडाटा (Bankdata) के एक नाजुक, वेंडर-लॉक्ड जेनकिन्स-आधारित कोबोल (COBOL) सीआई/सीडी (CI/CD) पाइपलाइन के एक कंटेनराइज्ड, एब्स्ट्रैक्टेड आर्किटेक्चर में सफल माइग्रेशन का एक केस स्टडी प्रस्तुत करता है, जिसने निष्पादन समय को 82% तक कम कर दिया और विनियमित वातावरण में लीगेसी सिस्टम्स को आधुनिक बनाने के लिए एक स्केलेबल मॉडल प्रदान किया।

Andreas Askholm, Kenneth Johnsen, Jacopo Mauro2026-04-02
💻 computer science

Containing the Reproducibility Gap: Automated Repository-Level Containerization for Scholarly Jupyter Notebooks

यह शोध पत्र विद्वत जुपिटर नोटबुक (scholarly Jupyter notebooks) के लिए कंटेनरीकृत निष्पादन वातावरण (containerized execution environments) उत्पन्न करने हेतु एक स्वचालित पाइपलाइन प्रस्तुत करता है, जो यह प्रदर्शित करता है कि यद्यपि कंटेनरीकरण निर्भरता-संबंधी विफलताओं को काफी हद तक हल कर देता है, फिर भी निरंतर रनटाइम त्रुटियों और स्टोकेस्टिक अनिश्चितता (stochastic non-determinism) के कारण पूर्ण बिट-वाइज पुनरुत्पादकता (bit-wise reproducibility) प्राप्त करने के लिए अपर्याप्त बना हुआ है।

Sheeba Samuel, Daniel Mietchen, Hemanta Lo, Martin Gaedke2026-04-02