💻 computer science

How Do Developers Maintain and Evolve Their Agents' Instructions? An Empirical Study

यह शोध पत्र एक बड़े पैमाने के अनुभवजन्य अध्ययन को प्रस्तुत करता है जो एजेंट कॉन्टेक्स्ट फाइल्स (ACFs) के विकास को सॉफ्टवेयर रखरखाव वर्गीकरण (taxonomy) का उपयोग करके वर्गीकृत करता है, कोड गुणवत्ता के साथ उनके जुड़ाव का विश्लेषण करता है, और स्वायत्त कोडिंग एजेंटों के शासन (governance) को सूचित करने के लिए उनके टेम्पोरल पैटर्न की जांच करता है।

Gianmario Voria, Alfonso Cannavale, Andrea De Lucia, Yutaro Kashiwa, Gemma Catolino, Fabio Palomba2026-06-25
💻 computer science

Semantic Code Clone Detection: Are We There Yet?

यह शोध पत्र एक व्यवस्थित अनुभवजन्य अध्ययन प्रस्तुत करता है जो यह प्रदर्शित करता है कि अत्याधुनिक सिमेंटिक कोड क्लोन डिटेक्टर, उच्च बेंचमार्क प्रदर्शन के बावजूद, वास्तविक दुनिया के परिदृश्यों में महत्वपूर्ण सामान्यीकरण संबंधी समस्याओं से ग्रस्त हैं क्योंकि वे मजबूत सिमेंटिक समझ के बजाय लेक्सिकल और स्ट्रक्चरल शॉर्टकट्स पर निर्भर करते हैं।

Zhiwei Xu, Weixian Deng, Xuyang Liu, Xiaolin Peng, Jiabao Gao, Tian Qiu, Hai Wan, Xibin Zhao2026-06-25
💻 computer science

Representation Matters: An Empirical Study of Program Representations for LLM Vulnerability Reasoning

यह शोध पत्र RepBench प्रस्तुत करता है, जो एक अनुभवजन्य अध्ययन है जो यह प्रदर्शित करता है कि स्टैटिक-एनालिसिस-आधारित स्ट्रक्चरल रिप्रेजेंटेशन (विशेष रूप से AST+PDG), संदर्भ के विसरण (context dilution) को कम करके और एक बेहतर सटीकता-ओवरहेड ट्रेडऑफ प्रदान करके, LLM भेद्यता पहचान (vulnerability detection) में कच्चे सोर्स कोड की तुलना में काफी बेहतर प्रदर्शन करते हैं।

Andrew Stoltman, Johnathan Tang, Haipeng Cai2026-06-25
🤖 AI

LibEvoBench: Probing Temporal Knowledge Stratification in Code Generation Models

यह शोध पत्र LibEvoBench, एक मल्टी-टास्क बेंचमार्क और सॉफ्टवेयर इवोल्यूशन अंडरस्टैंडिंग स्कोर (SEUS) मेट्रिक प्रस्तुत करता है जो विकसित होती लाइब्रेरी API को संभालने की लार्ज लैंग्वेज मॉडल्स की क्षमता का मूल्यांकन करता है, जिससे यह पता चलता है कि वर्तमान मॉडल काफी हद तक वर्ज़न-विस्मृत (version-oblivious) हैं और स्पष्ट वर्ज़न विशिष्टताओं के बावजूद कालभ्रमित त्रुटियों (anachronistic errors) के प्रति संवेदनशील हैं।

Daniele Cipollone, Sergey Titov, Maliheh Izadi, Egor Bogomolov, Arie van Deursen2026-06-25
🤖 AI

The impact of artificial intelligence on enterprise software user roles

SAP के बिजनेस टेक्नोलॉजी प्लेटफॉर्म का यह गुणात्मक अध्ययन यह प्रकट करता है कि आर्टिफिशियल इंटेलिजेंस, कार्य स्वचालन (टास्क ऑटोमेशन) और एजेंटिक सहयोग के माध्यम से एंटरप्राइज सॉफ्टवेयर उपयोगकर्ता भूमिकाओं को मौलिक रूप से रूपांतरित कर रहा है, जिससे संशोधित भूमिका वर्गीकरण (रोल टैक्सोनॉमी), नए गवर्नेंस फ्रेमवर्क और AI-नेटिव सिस्टम के लिए अपडेटेड डिजाइन दृष्टिकोणों की आवश्यकता हो रही है।

Isabel Unger, Elizangela Valarini, Martin Schrepp, Nina Hollender, Gabriela Rocha, Erik Bertram2026-06-25
💬 NLP

Evaluating LLMs on Real-World Software Performance Optimization

यह शोध पत्र SWE-Pro को प्रस्तुत करता है, जो 102 विशेषज्ञ अनुकूलनों (optimizations) से व्युत्पन्न एक कठोर रिपॉजिटरी-स्तरीय बेंचमार्क है, जो यह प्रकट करता है कि वर्तमान लार्ज लैंग्वेज मॉडल्स वास्तविक दुनिया के सॉफ्टवेयर अनुकूलन में मानव-स्तर के प्रदर्शन के साथ मेल खाने में काफी विफल रहते हैं, और विशेषज्ञ इंजीनियरों द्वारा प्रदान की गई पर्याप्त गति वृद्धि (speedups) और मेमोरी कटौती की तुलना में नगण्य लाभ प्राप्त करते हैं।

Ezgi Sarıkayak, Wenchao Gu, Hesham Ghonim, Chunyang Chen2026-06-25
💻 computer science

Automated Detection of Configuration-Specific Security Vulnerabilities via Patch Analysis

यह शोध पत्र पैचलेंस (PatchLens) को प्रस्तुत करता है, जो एक स्टैटिक एनालिसिस तकनीक है जो अत्यधिक कॉन्फ़िगर करने योग्य C/C++ सिस्टम में विशिष्ट कंपाइल-टाइम कॉन्फ़िगरेशन के साथ सुरक्षा पैच को मैप करके सटीक वल्नरेबिलिटी इम्पैक्ट कंडीशंस (VICs) को स्वचालित रूप से व्युत्पन्न करता है, जिससे बिना सिस्टम कंपाइलेशन की आवश्यकता के लक्षित वल्नरेबिलिटी असेसमेंट सक्षम होता है और विरल (sparse) CVE विवरणों को समृद्ध किया जाता है।

Felipe de Sant'Anna Paixão, Joanna C. S. Santos, Paulo Anselmo da Mota Silveira Neto, Daniel Sadoc Menasche, Gustavo Bit (…)2026-06-25
💻 computer science

LLM-Based Discovery of Latent Requirements from Stakeholder Conversations: Preliminary Results from Industry

यह शोध पत्र LENS को प्रस्तुत करता है, जो एक LLM-आधारित दृष्टिकोण है जो स्पष्ट आवश्यकताओं को निकालने और संगठनात्मक संदर्भ पर तर्क करके अंतर्निहित (latent) आवश्यकताओं का अनुमान लगाने के लिए स्टेकहोल्डर साक्षात्कार ट्रांसक्रिप्ट का विश्लेषण करता है, जो निष्कर्षण में उच्च सटीकता और एक औद्योगिक साइबर सुरक्षा मूल्यांकन में महत्वपूर्ण व्यावहारिक मूल्य प्रदर्शित करता है।

Mithila Sivakumar, Martin Lochner, Shiva Nejati, Mehrdad Sabetzadeh2026-06-25
💻 computer science

The Dependency Black Hole

267 माइक्रोसर्विसेज के एक खोजपूर्ण केस स्टडी के माध्यम से, यह शोध पत्र "डिपेंडेंसी ब्लैक होल" (dependency black hole) सिद्धांत प्रस्तुत करता है, जो बड़े पैमाने के सिस्टम में डिपेंडेंसी संकेंद्रण कैसे विकसित होता है, इसे समझाने और गवर्नेंस हस्तक्षेपों को निर्देशित करने के लिए डिपेंडेंसी मैग्नेट्स के एक सघन कोर और उसके चारों ओर तेजी से उलझते हुए सर्विसेज के मॉडल को प्रस्तुत करता है।

Ehsan Zabardast, Bhuwan Paudel, Javier Gonzalez-Huerta2026-06-25
🤖 AI

Helpful or Harmful? Evaluating LLM-Assisted Vulnerability Patching via a Human Study

यह शोध पत्र एक नियंत्रित क्रॉसओवर डिज़ाइन और छिपे हुए सुरक्षा परीक्षणों का उपयोग करते हुए एक अनुभवजन्य मानव अध्ययन प्रस्तुत करता है, जो यह मूल्यांकन करता है कि क्या LLM-सहायता प्राप्त भेद्यता पैचिंग (vulnerability patching), मैनुअल डिबगिंग की तुलना में सुधार की गति को तेज करता है या असुरक्षित, सतही सुधार पेश करने का जोखिम उठाता है।

Giulian Biolo, Michael Tezza, Yuanjun Gong, Fabio Massacci2026-06-25