🤖 AI

KEEP: A KV-Cache-Centric Memory Management System for Efficient Embodied Planning

यह शोध पत्र KEEP को प्रस्तुत करता है, जो एक KV-कैश-केंद्रित मेमोरी प्रबंधन प्रणाली है जो स्टैटिक-डायनामिक कंस्ट्रक्शन, मल्टी-हॉप री-कंप्यूटेशन और लेयर-बैलेंस्ड लोडिंग का उपयोग करती है ताकि उच्च सटीकता बनाए रखते हुए मेमोरी-ऑगमेंटेड LLMs में एम्बोडीड प्लानिंग (embodied planning) को महत्वपूर्ण रूप से त्वरित किया जा सके।

Zebin Yang, Tong Xie, Baotong Lu, Shaoshan Liu, Bo Yu, Meng Li2026-03-18
💻 computer science

The Impact of AI-Assisted Development on Software Security: A Study of Gemini and Developer Experience

159 डेवलपर्स के इस अध्ययन से पता चलता है कि जबकि गूगल का एआई टूल जेमिनी (Gemini) इसके संस्करण (मुफ्त या सशुल्क) के बावजूद कोड सुरक्षा परिणामों को महत्वपूर्ण रूप से नहीं बदलता है, एक डेवलपर का अपना प्रोग्रामिंग अनुभव सुरक्षित सॉफ्टवेयर बनाने के लिए महत्वपूर्ण कारक बना हुआ है और इसे एआई सहायता द्वारा पूरी तरह से प्रतिस्थापित नहीं किया जा सकता है।

Nadine Jost, Benjamin Berens, Manuel Karl, Stefan Albert Horstmann, Martin Johns, Alena Naiakshina2026-03-18
💻 computer science

Constructing Weakly Terminating Interface Protocols

यह शोध पत्र एक आंशिक मिररिंग संबंध (partial mirroring relation) का उपयोग करके एक सर्वर विनिर्देश से संगत क्लाइंट्स के एक वर्ग को व्युत्पन्न करके कमजोर रूप से समाप्त होने वाले इंटरफ़ेस प्रोटोकॉल (weakly terminating interface protocols) निर्मित करने के लिए मौजूदा परिणामों का सामान्यीकरण करता है, और एक ओपन-सोर्स टूल के माध्यम से इस सिद्धांत के व्यावहारिक अनुप्रयोग को प्रदर्शित करता है।

Debjyoti Bera, Tim A. C. Willemse2026-03-18
💻 computer science

Loosely-Structured Software: Engineering Context, Structure, and Evolution Entropy in Runtime-Rewired Multi-Agent Systems

यह शोध पत्र लूज़ली-स्ट्रक्चर्ड सॉफ़्टवेयर (LSS) प्रस्तुत करता है, जो LLM-आधारित मल्टी-एजेंट सिस्टम के लिए एक नया इंजीनियरिंग प्रतिमान है, जो स्वायत्त, स्वयं-पुनर्लेखन करने वाले एजेंटों की डिज़ाइनक्षमता, स्केलेबिलिटी और विकासक्षमता को बढ़ाने के लिए व्यू (View), स्ट्रक्चर (Structure) और इवोल्यूशन (Evolution) इंजीनियरिंग के तीन-स्तरीय ढांचे के माध्यम से रनटाइम एंट्रॉपी का प्रबंधन करता है।

Weihao Zhang, Yitong Zhou, Huanyu Qu, Hongyi Li2026-03-18
💻 computer science

VibeContract: The Missing Quality Assurance Piece in Vibe Coding

यह विजन पेपर "वाइबकॉन्ट्रैक्ट" (VibeContract) प्रतिमान का प्रस्ताव करता है, जो एक संरचित गुणवत्ता आश्वासन ढांचा है जो प्राकृतिक भाषा के इरादों को स्पष्ट, सत्यापन योग्य कार्य अनुबंधों में विघटित करता है ताकि परीक्षण और डिबगिंग को निर्देशित किया जा सके, जिससे त्रुटि-प्रवण "वाइब कोडिंग" अभ्यास को एक अनुमानित और विश्वसनीय सॉफ्टवेयर इंजीनियरिंग प्रक्रिया में बदला जा सके।

Song Wang2026-03-18
💻 computer science

This Is Taking Too Long -- Investigating Time as a Proxy for Energy Consumption of LLMs

यह शोध पत्र API-आधारित लार्ज लैंग्वेज मॉडल्स की अपारदर्शी ऊर्जा खपत का अनुमान लगाने के लिए इन्फरेंस टाइम (inference time) को एक प्रॉक्सी के रूप में उपयोग करने का प्रस्ताव देता है, जो स्थानीय रूप से होस्ट किए गए समकक्षों के वास्तविक ऊर्जा डेटा के साथ समय के मापन को सह-संबंधित करके इस दृष्टिकोण को मान्य करता है ताकि उपयोगकर्ताओं को पर्यावरणीय लागत समझने में मदद मिल सके।

Lars Krupp, Daniel Geißler, Francisco M. Calatrava-Nicolas, Vishal Banwari, Paul Lukowicz, Jakob Karolus2026-03-18
💻 computer science

SEMAG: Self-Evolutionary Multi-Agent Code Generation

SEMAG एक स्व-विकसित बहु-एजेंट ढांचा है जो मानव कोडिंग प्रथाओं की नकल करते हुए कार्यों को गतिशील रूप से विघटित करता है और अपने बैकबोन मॉडलों को स्वचालित रूप से अपग्रेड करता है, जिससे CodeContests जैसे बेंचमार्क पर अत्याधुनिक प्रदर्शन प्राप्त होता है।

Yulin Peng, Haowen Hou, Xinxin Zhu, Ying Tiffany He, F. Richard Yu2026-03-18
💻 computer science

ClawWorm: Self-Propagating Attacks Across LLM Agent Ecosystems

यह शोध पत्र ClawWorm को प्रस्तुत करता है, जो OpenClaw जैसे प्रोडक्शन-स्केल LLM एजेंट पारिस्थितिक तंत्रों को लक्षित करने वाला पहला स्व-प्रसारित वर्म हमला है, जो निरंतरता के लिए कॉन्फ़िगरेशन को स्वायत्त रूप से हाईजैक करता है और बिना किसी अतिरिक्त हमलावर हस्तक्षेप के मल्टी-एजेंट नेटवर्क में फैलता है।

Yihao Zhang, Zeming Wei, Xiaokun Luan, Chengcan Wu, Zhixin Zhang, Jiangrong Wu, Haolin Wu, Huanran Chen, Jun Sun, Meng S (…)2026-03-18
💻 computer science

Self-Admitted Technical Debt in Scientific Software: Prioritization, Sentiment, and Propagation Across Artifacts

यह अध्ययन वैज्ञानिक सॉफ़्टवेयर में स्व-स्वीकृत तकनीकी ऋण (self-admitted technical debt) का विश्लेषण करने के लिए इसके प्राथमिकता निर्धारण, भावना (sentiment), और क्रॉस-आर्टिफैक्ट प्रसार (cross-artifact propagation) की जांच करता है, जिससे यह पता चलता है कि टिप्पणियों (comments) और कमिट्स (commits) में ऋण को नकारात्मक भावना के साथ होने पर उच्च प्राथमिकता दी जाती है, जबकि समाधान दर ओपन-सोर्स औसत से पीछे रहती है और प्रसार उच्च-प्रभाव वाले, निरंतर जारी रहने वाले मुद्दों के साथ सह-संबंधित होता है।

Eric L. Melin, Nasir U. Eisty, Gregory R. Watson, Addi Malviya-Thakur2026-03-18
💻 computer science

VIBEPASS: Can Vibe Coders Really Pass the Vibe Check?

यह शोध पत्र VIBEPASS प्रस्तुत करता है, जो फॉल्ट-ट्रिगरिंग टेस्ट जनरेशन और फॉल्ट-टारगेटेड प्रोग्राम रिपेयर पर 12 फ्रंटियर LLMs का मूल्यांकन करने वाला एक बेंचमार्क है, जो यह प्रकट करता है कि जबकि मॉडल सिंटैक्टिक कोड और टेस्ट जनरेशन में उत्कृष्ट हैं, उनकी फॉल्ट-टारगेटेड रीजनिंग करने में अक्षमता—विशेष रूप से डिस्क्रिमिनेटिव हाइपोथीसिस उत्पन्न करने की अक्षमता—स्वायत्त डिबगिंग के लिए एक महत्वपूर्ण बाधा बनी हुई है, जिसके कारण जब टेस्ट अंतर्निहित दोष (fault) को सफलतापूर्वक प्रमाणित नहीं कर पाते हैं, तो सेल्फ-गाइडेड रिपेयर विफल हो जाता है।

Srijan Bansal, Jiao Fangkai, Yilun Zhou, Austin Xu, Shafiq Joty, Semih Yavuz2026-03-18