🤖 AI

An Empirical Study of the Imbalance Issue in Software Vulnerability Detection

यह शोधपत्र अनुभवजन्य रूप से इस बात की पुष्टि करता है कि क्लास इम्बैलेंस (class imbalance) डीप लर्निंग-आधारित सॉफ्टवेयर भेद्यता पहचान (software vulnerability detection) में एक मुख्य चुनौती है और यह मूल्यांकन करता है कि विभिन्न इम्बैलेंस न्यूनीकरण रणनीतियाँ (imbalance mitigation strategies) विभिन्न डेटासेट्स और मॉडल्स में प्रिसिजन (precision), रिकॉल (recall) और एफ1-मेज़र (F1-measure) को किस प्रकार अलग-अलग तरह से प्रभावित करती हैं।

Yuejun Guo, Qiang Hu, Qiang Tang, Yves Le Traon2026-02-13
🤖 AI

ModelWisdom: An Integrated Toolkit for TLA+ Model Visualization, Digest and Repair

ModelWisdom एक इंटरैक्टिव टूलकिट है जो उन्नत विज़ुअलाइज़ेशन तकनीकों और लार्ज लैंग्वेज मॉडल्स को एकीकृत करके TLA+ मॉडल चेकिंग को बेहतर बनाता है ताकि काउंटरएग्जांपलल इंटरप्रिटेशन को सरल बनाया जा सके, स्टेट ग्राफ प्रबंधन को अनुकूलित किया जा सके, और स्वचालित मॉडल रिपेयर को सुगम बनाया जा सके।

Zhiyong Chen, Jialun Cao, Chang Xu, Shing-Chi Cheung2026-02-13
🤖 AI

On the Adoption of AI Coding Agents in Open-source Android and iOS Development

यह शोधपत्र ओपन-सोर्स मोबाइल डेवलपमेंट में एआई कोडिंग एजेंट्स का पहला अनुभवजन्य अध्ययन प्रस्तुत करता है, जो 2,901 पुल रिक्वेस्ट का विश्लेषण करके यह प्रकट करता है कि एंड्रॉइड प्रोजेक्ट्स को आईओएस की तुलना में अधिक एआई योगदान और उच्च स्वीकृति दर प्राप्त होती है, जबकि संरचनात्मक परिवर्तनों की तुलना में नियमित कार्य अधिक सफल होते हैं।

Muhammad Ahmad Khan, Hasnain Ali, Muneeb Rana, Muhammad Saqib Ilyas, Abdul Ali Bangash2026-02-13
💻 computer science

Unknown Attack Detection in IoT Networks using Large Language Models: A Robust, Data-efficient Approach

यह शोध पत्र SiamXBERT का प्रस्ताव करता है, जो एक सुदृढ़ और डेटा-कुशल सियामी मेटा-लर्निंग फ्रेमवर्क है जो अज्ञात हमलों का पता लगाने के लिए फ्लो और पैकेट-स्तरीय विशेषताओं को एकीकृत करने हेतु एक ट्रांसफार्मर-आधारित लैंग्वेज मॉडल का लाभ उठाता है, जो मौजूदा अत्याधुनिक विधियों की तुलना में न्यूनतम लेबल वाले डेटा के साथ बेहतर प्रदर्शन प्राप्त करता है।

Shan Ali, Feifei Niu, Paria Shirani, Lionel C. Briand2026-02-13
💻 computer science

Automated Test Suite Enhancement Using Large Language Models with Few-shot Prompting

यह शोध पत्र अनुभवजन्य रूप से प्रदर्शित करता है कि लार्ज लैंग्वेज मॉडल्स के साथ फ्यू-शॉट प्रॉम्प्टिंग, विशेष रूप से मानव-लिखित उदाहरणों और समस्या विवरण एवं कोड समानता के संयोजन पर आधारित रिट्रीवल रणनीतियों का उपयोग करने पर, पारंपरिक तरीकों की तुलना में स्वचालित यूनिट टेस्ट की गुणवत्ता, कवरेज और रखरखाव क्षमता में महत्वपूर्ण रूप से वृद्धि करता है।

Alex Chudic, Gül Çalıklı2026-02-13
💻 computer science

QUT-DV25: A Dataset for Dynamic Analysis of Next-Gen Software Supply Chain Attacks

यह शोध पत्र QUT-DV25 को प्रस्तुत करता है, जो 14,000 से अधिक पायथन पैकेज के वास्तविक समय के निष्पादन ट्रेस (execution traces) वाला एक नया डायनेमिक विश्लेषण डेटासेट है, जिसे उन परिष्कृत, बहु-चरणीय सॉफ्टवेयर आपूर्ति श्रृंखला हमलों का पता लगाने के लिए डिज़ाइन किया गया है जो पारंपरिक स्टेटिक और मेटाडेटा-आधारित पहचान विधियों से बच निकलते हैं।

Sk Tanzir Mehedi, Raja Jurdak, Chadni Islam, Gowri Ramachandran2026-02-12
💻 computer science

Analyzing GitHub Issues and Pull Requests in nf-core Pipelines: Insights into nf-core Pipeline Repositories

यह अनुभवजन्य अध्ययन BERTopic मॉडलिंग का उपयोग करके nf-core पाइपलाइनों के 25,000 से अधिक GitHub इश्यू और पुल रिक्वेस्ट का विश्लेषण करता है ताकि प्रमुख विकास चुनौतियों की पहचान की जा सके और यह प्रकट किया जा सके कि लेबल और कोड स्निपेट्स का उपयोग इश्यू समाधान दक्षता में महत्वपूर्ण सुधार करता है।

Khairul Alam, Banani Roy2026-02-12
🤖 AI

World of Workflows: A Benchmark for Bringing World Models to Enterprise Systems

यह शोध पत्र "वर्ल्ड ऑफ वर्कफ्लोज़" (WoW) को पेश करता है, जो एक वास्तविक ServiceNow वातावरण पर आधारित एक नया बेंचमार्क है जिसे यह मूल्यांकन करने के लिए डिज़ाइन किया गया है कि क्या अत्याधुनिक LLMs छिपे हुए वर्कफ्लो और उनके कार्यों के क्रमिक दुष्प्रभावों की भविष्यवाणी करके जटिल एंटरप्राइज सिस्टम्स में नेविगेट कर सकते हैं।

Lakshya Gupta, Litao Li, Yizhe Liu, Sriram Ganapathi Subramanian, Kaheer Suleman, Zichen Zhang, Haoye Lu, Sumit Pasupala (…)2026-02-12
🤖 machine learning

Basic Legibility Protocols Improve Trusted Monitoring

यह शोध पत्र "लिजिबिलिटी प्रोटोकॉल" (legibility protocols) का प्रस्ताव करता है, जैसे कि अविश्वसनीय AI मॉडलों को कोड कमेंट्स प्रदान करने के लिए प्रोत्साहित करना, ताकि कार्य प्रदर्शन से समझौता किए बिना मॉडल के कार्यों को एक पर्यवेक्षक के लिए मूल्यांकन करना आसान बनाकर विश्वसनीय निगरानी की प्रभावशीलता में सुधार किया जा सके।

Ashwin Sreevatsa, Sebastian Prasanna, Cody Rushing2026-02-12
🤖 AI

EvoCodeBench: A Human-Performance Benchmark for Self-Evolving LLM-Driven Coding Systems

EvoCodeBench एक नया बेंचमार्क है जिसे स्व-विकसित (self-evolving) LLM-संचालित कोडिंग प्रणालियों का मूल्यांकन करने के लिए डिज़ाइन किया गया है, जो कई प्रोग्रामिंग भाषाओं में प्रदर्शन की गतिशीलता—जैसे कि शुद्धता, दक्षता और एल्गोरिद्मिक सुधार—को ट्रैक करता है और तुलना के लिए एक मानव-केंद्रित संदर्भ ढांचा प्रदान करता है।

Wentao Zhang, Jianfeng Wang, Liheng Liang, Yilei Zhao, HaiBin Wen, Zhe Zhao2026-02-12