💻 computer science

KISS Sorcar: A Stupidly-Simple General-Purpose and Software Engineering AI Assistant

KISS Sorcar एक निःशुल्क, ओपन-सोर्स VS Code एक्सटेंशन है जो एक न्यूनतम 1,850-लाइन वाले एजेंट फ्रेमवर्क पर निर्मित है जो पांच-स्तरीय पदानुक्रम, परीक्षण के माध्यम से स्व-सत्यापन और गिट आइसोलेशन (git isolation) का उपयोग करता है ताकि टर्मिनल बेंच 2.0 पर 62.2% पास रेट प्राप्त किया जा सके, जो लंबी अवधि के सॉफ्टवेयर इंजीनियरिंग कार्यों में क्लाउड कोड (Claude Code) और कर्सर कंपोजर (Cursor Composer) जैसे मौजूदा टूल्स से बेहतर प्रदर्शन करता है।

Koushik Sen2026-04-28
💻 computer science

Learning Selective LLM Autonomy from Copilot Feedback in Enterprise Customer Support Workflows

यह शोध पत्र एक तैनात प्रणाली प्रस्तुत करता है जो एंटरप्राइज कस्टमर सपोर्ट वर्कफ़्लो को ऑटोमेट करने के लिए एक चयनात्मक (selective) LLM एजेंट को प्रशिक्षित करने हेतु कोपायलट फीडबैक और UI इंटरेक्शन ट्रेसेस का लाभ उठाती है, जिससे गुणवत्ता को कॉन्फिडेंस-आधारित एब्स्टेंशन मैकेनिज्म के माध्यम से बनाए रखते हुए 45% ऑटोमेशन दर और हैंडलिंग समय में 39% की कमी हासिल की गई है।

Nikita Borovkov, Elisei Rykov, Olga Tsymboi, Sergei Filimonov, Nikita Surnachev, Dmitry Bitman, Anatolii Potapov2026-04-28
💻 computer science

Optimas: An Intelligent Analytics-Informed Generative AI Framework for Performance Optimization

Optimas एक स्वचालित, मल्टी-एजेंट जनरेटिव AI फ्रेमवर्क है जो परफॉरमेंस डायग्नोस्टिक्स और एक्शनबल कोड ट्रांसफॉर्मेशन के बीच के अंतर को पाटता है, जो व्यापक वास्तविक-दुनिया के प्रयोगों में NVIDIA GPUs पर 100% कोड शुद्धता और महत्वपूर्ण प्रदर्शन लाभ (8.02%–79.09%) प्राप्त करता है।

Mohammad Zaeed, Tanzima Z. Islam, Vladimir Indic2026-04-28
💻 computer science

Vulnerability Identification by Harnessing Inter-connected Multi-Source Information

यह शोध पत्र VPFinder प्रस्तुत करता है, जो एक AI-संचालित दृष्टिकोण है जो सॉफ्टवेयर डिपेंडेंसीज़ में भेद्यता (vulnerability) की पहचान और वर्गीकरण में महत्वपूर्ण सुधार करने के लिए परस्पर जुड़े बहु-स्रोत सूचनाओं (जैसे बग रिपोर्ट, कमिट संदेश और कोड परिवर्तन) को एकीकृत करने हेतु मल्टी-हेड अटेंशन मैकेनिज्म का लाभ उठाता है।

Liyou Chen, Hailong Sun, Xiang Gao, Lin Shi, Yixin Yang, Yi Xu2026-04-28
💻 computer science

AgentPulse: A Continuous Multi-Signal Framework for Evaluating AI Agents in Deployment

एजेंटपल्स (AgentPulse) एक निरंतर, बहु-संकेत मूल्यांकन ढांचे को पेश करता है जो वास्तविक तैनाती परिदृश्यों में एआई एजेंटों के प्रदर्शन और प्रभाव का समग्र मूल्यांकन प्रदान करने के लिए एडॉप्शन (adoption), कम्युनिटी और इकोसिस्टम स्रोतों से रीयल-टाइम डेटा को एकत्रित करके स्टेटिक बेंचमार्क का पूरक बनता है।

Yuxuan Gao, Megan Wang, Yi Ling Yu2026-04-28
💻 computer science

How Do Developers Use Migration Guides? A Case Study of Log4j

यह शोध पत्र Log4j के एक केस स्टडी के माध्यम से माइग्रेशन गाइड्स (migration guides) के प्रावधान और व्यावहारिक उपयोग की जांच करता है, जिससे यह पता चलता है कि डेवलपर्स अक्सर पुल रिक्वेस्ट (pull requests) में संपूर्ण गाइड का संदर्भ देते हैं और इन संसाधनों का उपयोग पूरे माइग्रेशन जीवनचक्र के दौरान करते हैं, न कि केवल प्रमुख संस्करण अपडेट के दौरान।

Takahiro Monno, Kazumasa Shimari, Tetsuya Kanda, Kazuma Yamasaki, Kenichi Matsumoto2026-04-28
💻 computer science

Evaluating Cryptographic API Misuse Detectors for Go

यह शोध पत्र Go में क्रिप्टोग्राफिक API के दुरुपयोग का 14 दुरुपयोग वर्गों (misuse classes) का एक वर्गीकरण स्थापित करके, 328 परियोजनाओं में चार डिटेक्शन टूल्स का मूल्यांकन करके, और वर्तमान डिटेक्शन कवरेज में महत्वपूर्ण अंतराल को उजागर करने के लिए 7,473 कमजोरियों की पहचान करके, Go में क्रिप्टोग्राफिक API के दुरुपयोग का पहला व्यापक अध्ययन प्रस्तुत करता है।

Vivi Andersson, Martin Monperrus2026-04-28
💻 computer science

Empowering Autonomous Debugging Agents with Efficient Dynamic Analysis

यह शोध पत्र एजेंट-सेंट्रिक डिबगिंग इंटरफेस (ADI) को प्रस्तुत करता है, जो फ्रेम लाइफटाइम ट्रेस द्वारा संचालित एक लागत-कुशल, फंक्शन-लेवल डिबगिंग फ्रेमवर्क है जो स्वायत्त प्रोग्राम रिपेयर एजेंटों को महत्वपूर्ण रूप से बढ़ाता है, जिससे एक बुनियादी एजेंट को SWE-bench के 63.8% कार्यों को हल करने में सक्षम बनाया जा सकता है और अत्याधुनिक प्रणालियों के साथ एकीकृत होने पर निरंतर प्रदर्शन लाभ प्रदान किया जा सकता है।

Jiahong Xiang, Xiaoyang Xu, Xiaopan Chu, Hongliang Tian, Yuqun Zhang2026-04-28
💻 computer science

RefEvo: Agentic Design with Co-Evolutionary Verification for Agile Reference Model Generation

RefEvo एक गतिशील मल्टी-एजेंट फ्रेमवर्क है जो हार्डवेयर मॉडलिंग में LLM की सीमाओं को दूर करने के लिए एक सह-विकासवादी सत्यापन तंत्र (co-evolutionary verification mechanism), एक स्पेक-एंकरिंग रणनीति (spec-anchoring strategy) और एक अनुकूली डिज़ाइन प्लानर (adaptive design planner) का लाभ उठाता है, जिससे उच्च-निष्ठा वाले SystemC रेफरेंस मॉडल उत्पन्न करने में 95% पास दर और महत्वपूर्ण टोकन बचत प्राप्त होती है।

Yifan Zhang, Jianmin Ye, Jiahao Yang, Xi Wang2026-04-28
🤖 machine learning

Diffusion Templates: A Unified Plugin Framework for Controllable Diffusion

डिफ्यूजन टेम्पलेट्स (Diffusion Templates) एक एकीकृत, ओपन-सोर्स प्लगइन फ्रेमवर्क है जो एक मानकीकृत इंटरफ़ेस के माध्यम से बेस डिफ्यूजन मॉडल्स को नियंत्रणीय क्षमताओं से अलग करता है, जिससे विभिन्न मॉडल बैकबोंक (backbones) के बीच विविध नियंत्रण विधियों (जैसे कि LoRA और KV-Cache) का मॉड्यूलर संयोजन और निर्बाध स्थानांतरण सक्षम होता है।

Zhongjie Duan, Hong Zhang, Yingda Chen2026-04-28