💻 computer science

Source Known Identifiers: A Three-Tier Identity System for Distributed Applications

यह शोध पत्र सोर्स नोन आइडेंटिफायर्स (SKIDs) को प्रस्तुत करता है, जो एक नवीन तीन-स्तरीय पहचान प्रणाली है जो वितरित अनुप्रयोगों में मौजूदा पहचान योजनाओं की सीमाओं को दूर करने के लिए कॉम्पैक्ट डेटाबेस स्टोरेज, कालानुक्रमिक क्रमबद्धता, मूल मेटाडेटा, ज़ीरो-लुकअप सत्यापन और गोपनीयता को एकीकृत करती है।

Duran Serkan Kılıç2026-04-03
💻 computer science

AI Engineering Blueprint for On-Premises Retrieval-Augmented Generation Systems

यह शोध पत्र स्केलेबल ऑन-प्रिमाइसेस रिट्रीवल-ऑगमेंटेड जनरेशन (RAG) सिस्टम के लिए एक व्यापक, सार्वजनिक रूप से उपलब्ध AI इंजीनियरिंग ब्लूप्रिंट प्रस्तुत करता है, जो 4+1 व्यू रेफरेंस आर्किटेक्चर, एक डिप्लॉयमेंट-रेडी एप्लिकेशन, और टूलिंग एवं CI/CD पाइपलाइनों के लिए सर्वोत्तम प्रथाओं को प्रदान करके एंटरप्राइज-ग्रेड फ्रेमवर्क में मौजूद अंतर को संबोधित करता है।

Nicolas Weeger, Jakob Winkler, Annika Stiehl, Jóakim von Kistowski, Christian Uhl, Stefan Geißelsöder2026-04-03
💻 computer science

Fuzzing with Agents? Generators Are All You Need

यह शोध पत्र Gentoo को प्रस्तुत करता है, जो एक ऐसा फ्रेमवर्क है जो जावा लाइब्रेरीज़ के लिए अत्यधिक प्रभावी, डोमेन-विशिष्ट इनपुट जनरेटरों को स्वचालित रूप से संश्लेषित करने के लिए AI कोडिंग एजेंटों का लाभ उठाता है, यह प्रदर्शित करते हुए कि एजेंट-निर्मित जनरेटर मानव-लिखित बेसलाइन की तुलना में बेहतर ब्रांच कवरेज प्राप्त करते हैं और पारंपरिक कवरेज-गाइडेड म्यूटेशन रणनीतियों को काफी हद तक अनावश्यक बना देते हैं।

Vasudev Vikram, Rohan Padhye2026-04-03
🤖 machine learning

CuTeGen: An LLM-Based Agentic Framework for Generation and Optimization of High-Performance GPU Kernels using CuTe

CuTeGen एक LLM-आधारित एजेंटिक फ्रेमवर्क है जो मैट्रिक्स गुणन और एक्टिवेशन वर्कलोड में प्रतिस्पर्धी प्रदर्शन और शुद्धता प्राप्त करने के लिए CuTe एब्स्ट्रैक्शन लेयर का उपयोग करते हुए, उच्च-प्रदर्शन वाले GPU कर्नेल्स के जनरेशन और पुनरावृत्ति अनुकूलन को एक संरचित जनरेट-टेस्ट-रिफाइन वर्कफ़्लो के माध्यम से स्वचालित करता है।

Tara Saba, Anne Ouyang, Xujie Si, Fan Long2026-04-03
💻 computer science

MOVis: A Visual Analytics Tool for Surfacing Missed Patches Across Software Variants

यह शोध पत्र MOVis को प्रस्तुत करता है, जो एक इंटरैक्टिव डेस्कटॉप टूल है जो सॉफ्टवेयर वेरिएंट्स के बीच छूटे हुए पैच को बग और पैच किए गए कोड के आमने-सामने तुलना करके विज़ुअलाइज़ करता है ताकि डेवलपर्स को अलग होते रिपॉजिटरीज़ में आवश्यक सुधारों को कुशलतापूर्वक पहचानने और प्रसारित करने में मदद मिल सके।

Jorge Gonzalo Delgado Cervantes, John Businge, Daniel Ogenrwot2026-04-03
💻 computer science

From SWE-ZERO to SWE-HERO: Execution-free to Execution-based Fine-tuning for Software Engineering Agents

यह शोध पत्र SWE-ZERO से SWE-HERO को प्रस्तुत करता है, जो एक दो-चरणीय फाइन-ट्यूनिंग फ्रेमवर्क है जो बड़े पैमाने पर निष्पादन-मुक्त (execution-free) सिमेंटिक प्रशिक्षण को लक्षित निष्पादन-समर्थित (execution-backed) परिशोधन के साथ जोड़कर ओपन-वेट फ्रंटियर LLMs को अत्याधुनिक सॉफ्टवेयर इंजीनियरिंग एजेंटों में आसत (distill) करता है, जिससे SWE-bench Verified पर 62.2% रिज़ॉल्यूशन दर प्राप्त होती है और मजबूत बहुभाषी स्थानांतरणीयता (multilingual transferability) प्रदर्शित होती है।

Nikolai Ludwig, Wasi Uddin Ahmad, Somshubra Majumdar, Boris Ginsburg2026-04-03
💻 computer science

Mitigating Implicit Inconsistencies in Patch Porting

यह शोध पत्र MIP का प्रस्ताव करता है, जो एक सहयोगात्मक प्रणाली है जो एक LLM, कंपाइलर और कोड विश्लेषण उपयोगिताओं को एकीकृत करती है ताकि स्वचालित पैच पोर्टिंग के दौरान अंतर्निहित, गैर-स्थानीय विसंगतियों को प्रभावी ढंग से हल किया जा सके, जिससे क्रॉस-फोर्क और क्रॉस-ब्रांच परिदृश्यों में मौजूदा बेसलाइन की तुलना में काफी बेहतर प्रदर्शन होता है।

Shengyi Pan, Zhongxin Liu, Jiayuan Zhou, Xing Hu, Xin Xia, Shanping Li2026-04-03
💻 computer science

Can Large Language Models Model Programs Formally?

यह शोधपत्र Model-Bench को प्रस्तुत करता है, जो एक बेंचमार्क और पाइपलाइन है जिसमें 400 पायथन प्रोग्राम शामिल हैं जिन्हें बड़े भाषा मॉडलों (Large Language Models) की सत्यापन-योग्य मॉडल चेकिंग विनिर्देशों (verification-ready model checking specifications) को स्वचालित रूप से उत्पन्न करने की क्षमता का मूल्यांकन करने और सुधारने के लिए डिज़ाइन किया गया है, जो इस क्षमता में वर्तमान महत्वपूर्ण सीमाओं को प्रकट करता है।

Zhiyong Chen, Jialun Cao, Jiarong Wu, Chang Xu, Shing-Chi Cheung2026-04-03
🤖 machine learning

RuleForge: Automated Generation and Validation for Web Vulnerability Detection at Scale

RuleForge एक AWS आंतरिक प्रणाली है जो एक नवीन LLM-as-a-judge कॉन्फिडेंस सिस्टम और इटरेटिव रिफाइनमेंट स्ट्रैटेजी का उपयोग करके Nuclei टेम्पलेट्स से वेब वल्नरेबिलिटी डिटेक्शन रूल्स के जनरेशन और वैलिडेशन को ऑटोमेट करती है, जो आधुनिक CVE डिस्क्लोजर के पैमाने को संबोधित करते हुए फॉल्स पॉजिटिव्स को काफी कम कर देती है।

Ayush Garg, Sophia Hager, Jacob Montiel, Aditya Tiwari, Michael Gentile, Zach Reavis, David Magnotti, Wayne Fullen2026-04-03
💻 computer science

Automated Functional Testing for Malleable Mobile Application Driven from User Intent

यह शोध पत्र \tool का प्रस्ताव करता है, जो एक स्वचालित ढांचा है जो लचीले (malleable) मोबाइल अनुप्रयोगों में उपयोगकर्ता-निर्दिष्ट कार्यात्मकताओं को सत्यापित करने के लिए GUI परीक्षण और ओरेकल (oracles) उत्पन्न करने हेतु LLMs का लाभ उठाता है, जिससे उत्पाद-प्रबंधक-संचालित से एंड-यूज़र-संचालित ऐप विकास की ओर बदलाव संभव हो पाता है।

Yuying Wang, Kaifeng Huang, Hao Deng, Zhiyuan Sun, Jinxuan Zhou, Shengjie Zhao2026-04-03