💻 computer science

JETO-Bench: A Reproducible Benchmark for Execution Time Improvement Patches in Java

यह शोध पत्र JETO-Mine को प्रस्तुत करता है, जो जावा में निष्पादन समय सुधार (execution time improvement) पैच के पुनरुत्पादक बेंचमार्क उत्पन्न करने के लिए एक नवीन कॉन्फ़िगर करने योग्य टूल है, जिसका उपयोग JETO-Bench बनाने के लिए किया गया था—जो 174 रिपॉजिटरी से पहचाने गए 660 पैच का एक डेटासेट है—और यह प्रदर्शित किया गया कि OpenHands जैसे वर्तमान कोडिंग एजेंट इन कार्यों पर 14.3% सफलता दर प्राप्त करते हैं और ओपन-सोर्स प्रोजेक्ट्स में प्रदर्शन-संबंधी परीक्षणों की महत्वपूर्ण कमी को उजागर करते हैं।

Khashayar Etemadi, Zhendong Su2026-07-01
💻 computer science

Interface-Variant Dynamics in Software Ecosystems: Resolver-Induced Selection and Adoption in Package Graphs

यह शोध पत्र वितरित सॉफ्टवेयर पारिस्थितिक तंत्रों (distributed software ecosystems) में इंटरफ़ेस-परिवर्तित गतिकी (interface-variant dynamics) के लिए एक पुनरुत्पादनीय अनुमानक ऑडिट (reproducible estimator audit) प्रस्तावित करता है, जो चयन गुणांकों (selection coefficients) को मापने के लिए पैकेज ग्राफों की माइनिंग करता है और इस बात का मूल्यांकन करता है कि क्या रिज़ॉल्वर-प्रेरित विशेषताएँ (resolver-induced features) अंगीकरण (adoption) की भविष्यवाणी कर सकती हैं, जो अंततः यह प्रकट करता है कि जबकि चेकर-व्युत्पन्न संकेत नैदानिक मूल्य (diagnostic value) दर्शाते हैं, वर्तमान रजिस्ट्री डेटा रिज़ॉल्वर बाधाओं और वास्तविक अंगीकरण परिणामों के बीच के लूप को बंद करने में विफल रहता है।

Faruk Alpay, Baris Basaran2026-07-01
🤖 machine learning

ANVIL: Anomaly-based Vulnerability Identification without Labelled Training Data

यह शोध पत्र ANVIL को प्रस्तुत करता है, जो एक अनसुपरवाइज्ड (unsupervised) भेद्यता पहचान ढांचा है जो मास्क पुनर्निर्माण (masked reconstruction) और एक हाइब्रिड स्कोरिंग तंत्र के माध्यम से कोड विसंगतियों की पहचान करने के लिए लार्ज लैंग्वेज मॉडल्स का लाभ उठाता है, जो सुपरवाइज्ड डिटेक्टरों की तुलना में बेहतर प्रदर्शन प्रदर्शित करता है और फज़र्स (fuzzers) के साथ एकीकृत होने पर पहले से अज्ञात कमजोरियों को सफलतापूर्वक उजागर करता है।

Weizhou Wang, Eric Liu, Xiangyu Guo, Xiao Hu, Ilya Grishchenko, David Lie2026-06-30
💻 computer science

Security Engineering in IIIf, Part II -- Shadowing the IIIf

यह शोध पत्र सूचना प्रवाह सुरक्षा (Information Flow Security) को औपचारिक रूप देने के लिए मॉर्गन की "शैडो" (Shadow) अवधारणा को पेश करके इसाबेल इनसाइडर एंड इंफ्रास्ट्रक्चर फ्रेमवर्क (IIIf) की सुरक्षा इंजीनियरिंग का विस्तार करता है, जिससे रिफाइनमेंट विरोधाभास (refinement paradox) को हल किया जाता है और एक फ्लाइट रडार सिस्टम उदाहरण के माध्यम से सुरक्षित रिफाइनमेंट की शर्तों को स्थापित किया जाता है।

Florian Kammüller2026-06-30
💻 computer science

PoCGen: Generating Proof-of-Concept Exploits for Vulnerabilities in Npm Packages

PoCGen एक नवीन ढांचा है जो लार्ज लैंग्वेज मॉडल्स, स्टैटिक एनालिसिस और डायनेमिक एनालिसिस को समन्वित करके npm पैकेज की कमजोरियों के लिए स्वायत्त रूप से प्रूफ-ऑफ-कांसेप्ट एक्सप्लॉइट्स उत्पन्न और सत्यापित करता है, जिससे 77% की सफलता दर प्राप्त होती है जो कम लागत पर मौजूदा बेसलाइन्स से काफी बेहतर प्रदर्शन करती है।

Deniz Simsek, Aryaz Eghbali, Michael Pradel2026-06-30
💻 computer science

Code Reasoning for Software Engineering Tasks: A Survey and A Call to Action

यह शोध पत्र सॉफ्टवेयर इंजीनियरिंग में लार्ज लैंग्वेज मॉडल्स के लिए टेस्ट-टाइम रीजनिंग तकनीकों का सर्वेक्षण करता है, जो यह प्रदर्शित करता है कि संरचना और निष्पादन फीडबैक जैसे कोड-विशिष्ट संकेतों का लाभ उठाना जटिल कार्यों पर प्रदर्शन को महत्वपूर्ण रूप से बढ़ाता है और कोड-केंद्रित रीजनिंग के लिए भविष्य की अनुसंधान दिशाओं को रेखांकित करता है।

Saurabh Pujar, Ira Ceka, Irene Manotas, Gail Kaiser, Baishakhi Ray, Shyam Ramji2026-06-30
💻 computer science

SWE-fficiency: Can Language Models Optimize Real-World Repositories on Real Workloads?

यह शोध पत्र SWE-fficiency को प्रस्तुत करता है, जो 498 वास्तविक-विश्व रिपॉजिटरी कार्यों वाला एक बेंचमार्क है जिसे कोड की शुद्धता बनाए रखते हुए उसके प्रदर्शन को अनुकूलित करने की भाषा मॉडलों की क्षमता का मूल्यांकन करने के लिए डिज़ाइन किया गया है, जो यह प्रकट करता है कि वर्तमान अत्याधुनिक एजेंट बॉटलनैक्स (bottlenecks) को स्थानीयकृत करने और जटिल कोडबेस में तर्क करने के मामले में मानव विशेषज्ञों की तुलना में काफी कम प्रदर्शन करते हैं।

Jeffrey Jian Ma, Milad Hashemi, Amir Yazdanbakhsh, Kevin Swersky, Ofir Press, Enhui Li, Vijay Janapa Reddi, Parthasarath (…)2026-06-30
💬 NLP

SpecMind: Cognitively Inspired, Interactive Multi-Turn Framework for Postcondition Inference

यह शोधपत्र SpecMind प्रस्तुत करता है, जो एक संज्ञानात्मक रूप से प्रेरित, संवादात्मक मल्टी-टर्न फ्रेमवर्क है जो मौजूदा सिंगल-पास विधियों की तुलना में LLM-जनित पोस्टकंडीशन्स (postconditions) की सटीकता और पूर्णता में उल्लेखनीय सुधार करने के लिए फीडबैक-संचालित तर्क और स्वायत्त स्टॉपिंग क्राइटेरिया का लाभ उठाता है।

Cuong Chi Le, Minh V. T Pham, Tung Vu Duy, Cuong Duc Van, Huy N. Phan, Hoang N. Phan, Tien N. Nguyen2026-06-30
💻 computer science

VulKey: Automated Vulnerability Repair Guided by Domain-Specific Repair Patterns

VulKey एक स्वचालित भेद्यता मरम्मत ढांचा (vulnerability repair framework) है जो विशेषज्ञ सुरक्षा ज्ञान के एक नवीन तीन-स्तरीय पदानुक्रमित अमूर्तता (three-level hierarchical abstraction) का लाभ उठाकर पैटर्न मिलान और कोड जनरेशन की दो-चरणीय प्रक्रिया को निर्देशित करता है, जिससे यह मौजूदा उपकरणों से काफी बेहतर प्रदर्शन करता है और C/C++ एवं Java बेंचमार्क पर अत्याधुनिक परिणाम प्राप्त करता है।

Jia Li, Zhuangbin Chen, Yuxin Su, Michael R. Lyu2026-06-30
💻 computer science

Project-wise Comparison of Software Birthmarks Using Weighted Partial Similarity

यह शोध पत्र एक प्रोजेक्ट-वार सॉफ्टवेयर बर्थमार्क तुलना ढांचा प्रस्तावित करता है जो आंशिक कोड पुन: उपयोग का मजबूती से पता लगाने और छोटे मॉड्यूल के कारण होने वाले फॉल्स पॉजिटिव को कम करने के लिए भारित एकत्रीकरण (weighted aggregation) और आंशिक समानता तंत्र का उपयोग करता है, जो विविध ओपन-सोर्स जावा प्रोजेक्ट्स में मौजूदा विधियों की तुलना में बेहतर प्रदर्शन प्रदर्शित करता है।

Nikolay Fedorov, Akito Monden, Hiroki Inayoshi, Haruaki Tamada, Masateru Tsunoda2026-06-30