💻 computer science

Towards Improving the External Validity of Software Engineering Experiments with Transportability Methods

यह विजन पेपर सॉफ्टवेयर इंजीनियरिंग अनुसंधान में ट्रांसपोर्टेबिलिटी (transportability) विधियों को प्रायोगिक और अवलोकनात्मक डेटा को संयोजित करने के एक सिद्धांतपूर्ण दृष्टिकोण के रूप में प्रस्तुत करता है ताकि सैंपलिंग सीमाओं को दूर किया जा सके, जिससे नियंत्रित प्रयोग के परिणामों की बाह्य वैधता और व्यावहारिक प्रयोज्यता को बढ़ाया जा सके।

Julian Frattini, Richard Torkar, Robert Feldt, Carlo Furia2026-04-10
💻 computer science

Externalization in LLM Agents: A Unified Review of Memory, Skills, Protocols and Harness Engineering

यह शोध पत्र एक एकीकृत सिस्टम-स्तरीय ढांचे को प्रस्तुत करता है जो यह तर्क देता है कि व्यावहारिक एलएलएम (LLM) एजेंटों की प्रगति केवल मॉडल वेट्स (weights) में सुधार करने के बजाय, हारनेस इंजीनियरिंग द्वारा समन्वित मेमोरी, स्किल्स और प्रोटोकॉल में संज्ञानात्मक बोझ को बाहरीकृत करने पर तेजी से निर्भर करती है।

Chenyu Zhou, Huacan Chai, Wenteng Chen, Zihan Guo, Rong Shan, Yuanyi Song, Tianyi Xu, Yingxuan Yang, Aofan Yu, Weiming Z (…)2026-04-10
💻 computer science

CIAO - Code In Architecture Out - Automated Software Architecture Documentation with Large Language Models

यह शोध पत्र CIAO को प्रस्तुत करता है, जो एक संरचित, मानकों-आधारित वर्कफ़्लो है जो GitHub रिपॉजिटरी से सुसंगत, सिस्टम-स्तरीय आर्किटेक्चरल दस्तावेज़ों को स्वचालित रूप से उत्पन्न करने के लिए लार्ज लैंग्वेज मॉडल्स का लाभ उठाता है, जिसे डेवलपर्स डायग्राम की गुणवत्ता और डिप्लॉयमेंट व्यू में कुछ सीमाओं के बावजूद मूल्यवान और सटीक पाते हैं।

Marco De Luca, Tiziano Santilli, Domenico Amalfitano, Anna Rita Fasolino, Patrizio Pelliccione2026-04-10
💻 computer science

Security Concerns in Generative AI Coding Assistants: Insights from Online Discussions on GitHub Copilot

यह शोध पत्र GitHub Copilot के संबंध में चार प्राथमिक सुरक्षा चिंताओं—डेटा रिसाव (data leakage), कोड लाइसेंसिंग, प्रतिकूल हमले (adversarial attacks), और असुरक्षित कोड सुझावों—की पहचान करने के लिए Stack Overflow, Reddit और Hacker News से ऑनलाइन चर्चाओं का विश्लेषण करता है, जिससे सॉफ्टवेयर विकास के लिए जनरेटिव AI के उपयोग में महत्वपूर्ण सीमाओं और समझौतों को रेखांकित किया गया है।

Nicolás E. Díaz Ferreyra, Monika Swetha Gurupathi, Zadia Codabux, Nalin Arachchilage, Riccardo Scandariato2026-04-10
💻 computer science

Vulnerability Detection with Interprocedural Context in Multiple Languages: Assessing Effectiveness and Cost of Modern LLMs

यह अध्ययन C, C++ और Python में 509 इंटरप्रोसिजरल (interprocedural) कमजोरियों पर चार आधुनिक LLMs का अनुभवजन्य मूल्यांकन करता है, जो यह प्रदर्शित करता है कि कॉलर (caller) और कैली (callee) संदर्भ को शामिल करने से पहचान प्रभावशीलता में महत्वपूर्ण वृद्धि होती है और Gemini 3 Flash सर्वोत्तम लागत-प्रभावशीलता प्रदान करता है जबकि Claude Haiku 4.5 सटीक पहचान और स्पष्टीकरण में उत्कृष्ट है।

Kevin Lira, Baldoino Fonseca, Davy Baía, Márcio Ribeiro, Wesley K. G. Assunção2026-04-10
💬 NLP

sciwrite-lint: Verification Infrastructure for the Age of Science Vibe-Writing

यह शोध पत्र sciwrite-lint को प्रस्तुत करता है, जो एक ओपन-सोर्स, स्थानीय सत्यापन उपकरण है जो संदर्भ अखंडता और उद्धरण समर्थन की जाँच करके वैज्ञानिक पांडुलिपियों को स्वचालित रूप से मान्य करने के लिए एआई (AI) का उपयोग करता है, साथ ही वैज्ञानिक तर्कों की दार्शनिक सुदृढ़ता का कम्प्यूटेशनल रूप से आकलन करने के लिए एक प्रयोगात्मक "SciLint स्कोर" का प्रस्ताव भी करता है।

Sergey V Samsonau2026-04-10
💻 computer science

A Study of LLMs' Preferences for Libraries and Programming Languages

यह शोध पत्र पहला अनुभवजन्य अध्ययन प्रस्तुत करता है जो यह प्रकट करता है कि बड़े भाषा मॉडल (लार्ज लैंग्वेज मॉडल्स) NumPy जैसी लोकप्रिय लाइब्रेरी और पायथन भाषा के प्रति गहरा पूर्वाग्रह प्रदर्शित करते हैं, जो अक्सर कार्य-विशिष्ट इष्टतमता के बजाय परिचितता को प्राथमिकता देते हैं और प्रशिक्षण एवं मूल्यांकन में लक्षित सुधारों को आवश्यक बनाते हैं।

Lukas Twist, Jie M. Zhang, Mark Harman, Don Syme, Joost Noppen, Helen Yannakoudakis, Detlef Nauck2026-04-09
💬 NLP

VisCoder2: Building Multi-Language Visualization Coding Agents

यह शोध पत्र VisCoder2 को प्रस्तुत करता है, जो बड़े पैमाने के VisCode-Multi-679K डेटासेट पर प्रशिक्षित बहु-भाषा विज़ुअलाइज़ेशन कोडिंग मॉडल्स का एक परिवार है और जिसे VisPlotBench के माध्यम से मूल्यांकित किया गया है, जो 12 प्रोग्रामिंग भाषाओं में इटरेटिव सेल्फ-डीबगिंग के माध्यम से मौजूदा ओपन-सोर्स बेसलाइन से काफी बेहतर प्रदर्शन करता है और प्रोप्राइटरी मॉडल के प्रदर्शन के करीब पहुँचता है।

Yuansheng Ni, Songcheng Cai, Xiangchao Chen, Jiarong Liang, Zhiheng Lyu, Jiaqi Deng, Kai Zou, Ping Nie, Fei Yuan, Xiang (…)2026-04-09
💻 computer science

EditFlow: Benchmarking and Optimizing Code Edit Recommendation Systems via Reconstruction of Developer Flows

एडेफ्लो (EditFlow) डेटा संग्रह और सिमुलेशन चुनौतियों से पार पाने के लिए टेम्पोरल एडिटिंग फ्लो (temporal editing flows) का पुनर्निर्माण करके, एआई कोड एडिटिंग की सटीकता और डेवलपर उत्पादकता के बीच के अंतर को संबोधित करता है, जिससे अनुशंसा प्रणालियों (recommendation systems) को डेवलपर्स की स्वाभाविक मानसिक प्रक्रियाओं के साथ संरेखित करने के लिए अनुकूलित करना सक्षम बनाया जा सके।

Chenyan Liu, Yun Lin, Jiaxin Chang, Jiawei Liu, Binhang Qi, Bo Jiang, Zhiyong Huang, Jin Song Dong2026-04-09
💻 computer science

Software Testing Beyond Closed Worlds: Open-World Games as an Extreme Case

यह शोध पत्र तर्क देता है कि पारंपरिक क्लोज्ड-वर्ल्ड (बंद-विश्व) सॉफ्टवेयर परीक्षण धारणाएं आधुनिक गतिशील प्रणालियों के लिए अपर्याप्त हैं, और ओपन-वर्ल्ड (खुले-विश्व) खेलों को एक चरम उदाहरण के रूप में उपयोग करते हुए अनिश्चितता, गैर-नियतिवाद और विकसित होती स्थितियों के तहत व्यवहार के लक्षण वर्णन पर केंद्रित एक नए परीक्षण प्रतिमान का प्रस्ताव देता है।

Yusaku Kato, Norihiro Yoshida, Erina Makihara, Katsuro Inoue2026-04-09