💻 computer science

Willing but Unable: Separating Refusal from Capability in Code LLMs via Abliteration

यह शोध पत्र प्रदर्शित करता है कि "एब्लिटरेशन" (abliteration), जो कि रिफ्यूज़ल दिशाओं को ऑर्थोगोनली प्रोजेक्ट करने वाली एक लो-रैंक वेट एडिटिंग तकनीक है, सुरक्षा-संरेखित कोड एलएलएम (LLM) की असुरक्षित कोड उत्पन्न करने से मना करने की प्रवृत्ति को उनकी वास्तविक पीढ़ी क्षमताओं से प्रभावी रूप से अलग कर सकता है, जिससे सिंटैक्टिक वैधता से समझौता किए बिना भेद्यता पहचान अनुसंधान के लिए लेबल किए गए असुरक्षित कोड का स्केलेबल उत्पादन सक्षम हो जाता है।

Cristina Carleo, Pietro Liguori, Naghmeh Ivaki, Domenico Cotroneo2026-06-05
💻 computer science

REStack: A Large-Scale Dataset of Reverse Engineering Discussions from Stack Exchange

यह शोध पत्र REStack को प्रस्तुत करता है, जो स्टैक एक्सचेंज प्लेटफॉर्म से रिवर्स इंजीनियरिंग चर्चाओं का एक बड़े पैमाने का डेटासेट है जिसमें 12,000 से अधिक चर्चाएँ शामिल हैं, जिसे छह श्रेणियों में 23 प्रमुख विषयों की पहचान करने के लिए व्यवस्थित रूप से विश्लेषित किया गया है और रिवर्स इंजीनियरिंग के लिए एआई-संचालित उपकरणों के अनुसंधान, शिक्षा और विकास का समर्थन करने के लिए मेटाडेटा के साथ समृद्ध किया गया है।

Md Humaun Kabir, Md Rakibul Islam, Farha Kamal2026-06-05
💻 computer science

STMutants: A Mutation Testing Dataset for Structured Text Programs in Industrial Automation

यह शोध पत्र STMutants को प्रस्तुत करता है, जो औद्योगिक स्वचालन में IEC 61131-3 स्ट्रक्चर्ड टेक्स्ट प्रोग्रामों के लिए पहला सार्वजनिक रूप से उपलब्ध म्यूटेशन टेस्टिंग डेटासेट है, जिसमें टेस्ट-सुइट प्रभावशीलता और सुरक्षा-महत्वपूर्ण PLC सॉफ्टवेयर के लिए AI-सहायता प्राप्त गुणवत्ता आश्वासन पर पुनरुत्पादक अनुसंधान को सक्षम करने के लिए 108 स्क्रीन किए गए म्यूटेंट्स शामिल हैं।

Md Humaun Kabir, Md Rakibul Islam, Helen H. Lou2026-06-05
💻 computer science

SmellBench: Towards Fine-Grained Evaluation of Code Agents on Refactoring Tasks

यह शोध पत्र स्मेलबेंच (SmellBench) को प्रस्तुत करता है, जो वास्तविक दुनिया के कोड स्मेल्स (code smells) को इंजेक्ट करके रिफैक्टरिंग कार्यों पर कोड एजेंटों का मूल्यांकन करने के लिए डिज़ाइन किया गया एक नया बेंचमार्क है, जो यह प्रकट करता है कि वर्तमान शीर्ष प्रदर्शन करने वाले मॉडल क्रॉस-फाइल समझ (cross-file understanding) में संघर्ष करते हैं और इन रखरखाव संबंधी समस्याओं को समाप्त करने में केवल मध्यम सफलता प्राप्त करते हैं।

Fake Lin, Binbin Hu, Xi Zhu, Ziwei Zhao, Zhi Zheng, Ziqi Liu, Zhiqiang Zhang, Jun Zhou, Tong Xu2026-06-05
🤖 AI

The End of Software Engineering: How AI Agents Are Fundamentally Restructuring the Software Paradigm

यह शोध पत्र तर्क देता है कि एआई (AI) एजेंटों का उदय सॉफ्टवेयर प्रतिमान के एक मौलिक पुनर्गठन का प्रतिनिधित्व करता है, जो स्थिर, मानव-लिखित कोड से गतिशील, एलएलएम (LLM)-संचालित रीजनिंग लूप की ओर स्थानांतरित हो रहा है और स्व-विकसित एजेंट पारिस्थित प्रणालियों की ओर संक्रमण को नेविगेट करने के लिए "एजेंटिक इंजीनियरिंग" के एक नए अनुशासन को आवश्यक बनाता है।

Zhenfeng Cao2026-06-05
🤖 AI

Enhancing Software Engineering Through Closed-Loop Memory Optimization

यह शोधपत्र \ours को प्रस्तुत करता है, जो एक क्लोज्ड-लूप फ्रेमवर्क है जो सॉफ्टवेयर इंजीनियरिंग एजेंटों में मेमोरी उपयोगिता को प्रमाणित डाउनस्ट्रीम प्रभाव के आधार पर अनुकूलित करता है, जिससे टास्क-एग्नोस्टिक मूल्यांकन और एनोटेशन-मुक्त अनुकूलन सक्षम होता है जो सफलता दर, रिज़ॉल्यूशन दक्षता और कम्प्यूटेशनल लागत में महत्वपूर्ण सुधार करता है।

Xuehang Guo, Zora Zhiruo Wang, Qingyun Wang, Graham Neubig, Xingyao Wang2026-06-05
🤖 AI

When Surface Form Changes Moderation Decisions: A Paired Study of Code-Mixed Workflow Instability

यह शोध पत्र यह प्रदर्शित करता है कि वर्कफ़्लो-स्तर के दृष्टिकोण के माध्यम से घृणा मॉडरेशन प्रणालियों का मूल्यांकन करने से स्वच्छ अंग्रेजी की तुलना में तमिल-अंग्रेजी कोड-मिश्रित इनपुट को संसाधित करते समय महत्वपूर्ण निर्णय अस्थिरता और बढ़ी हुई परिचालन संबंधी बाधाएं प्रकट होती हैं, जो उन विफलताओं को उजागर करती हैं जिन्हें मानक वर्गीकरण मीट्रिक अक्सर अनदेखा कर देते हैं।

Suraj Babu Thimma Krishnaram2026-06-05
📈 economics

Econstellar: An Open-Source AI-Augmented Research Engine for Computational Financial Econometrics

इकोन्स्टेलर (Econstellar) एक ओपन-सोर्स, एआई-संवर्धित अनुसंधान इंजन है जो जनता को सीधे वेब ब्राउज़र में प्रकाशन-स्तर के वित्तीय अर्थमितीय विश्लेषणों को चलाने, सत्यापित करने और संशोधित करने में सक्षम बनाता है, जिससे अनुसंधान दावों और स्वतंत्र पुनरुत्पादकता के बीच के अंतर को पाटा जा सके।

Avishek Bhandari2026-06-05
🤖 AI

Microskill Architecture: A Modular Skill-Driven Framework for AI-Native Code Generation

यह शोध पत्र माइक्रोस्किल आर्किटेक्चर (MicroSkill Architecture) का परिचय देता है, जो एक मॉड्यूलर फ्रेमवर्क है जो ज्ञान को परमाणु कौशल कैप्सूल (atomic skill capsules) में विभाजित करता है और केवल प्रासंगिक संदर्भ चुनने के लिए एक डायनेमिक राउटर का उपयोग करता है, जिससे टोकन की खपत में 90% से अधिक की कमी आती है और AI-नेटिव कोड जनरेशन में संकलन सफलता (compilation success) और वास्तुशिल्प अखंडता (architectural integrity) में महत्वपूर्ण सुधार होता है।

Mohammad Zare, Omid Abdolrahmani2026-06-05
🤖 AI

Human Oversight and Overload: Two Hidden and Costly Burdens of AI-Assisted Software Engineering

यह शोध पत्र एआई-सहायता प्राप्त सॉफ्टवेयर इंजीनियरिंग के दो अक्सर अनदेखे, महंगी लागत वाले बोझों की पहचान और लक्षण वर्णन करता है: एआई-जनित आर्टिफैक्ट्स (artifacts) की मानवीय निगरानी की अनिवार्य आवश्यकता और एआई सुझावों की अत्यधिक मात्रा के कारण होने वाला संज्ञानात्मक भार (cognitive overload)।

Vahid Garousi2026-06-05