💻 computer science

Auditing MCP Servers for Over-Privileged Tool Capabilities

यह शोध पत्र mcp-sec-audit को प्रस्तुत करता है, जो एक विस्तार योग्य सुरक्षा टूलकिट है जो मॉडल कॉन्टेक्स्ट प्रोटोकॉल (MCP) सर्वरों में अत्यधिक विशेषाधिकार प्राप्त क्षमताओं का पता लगाने और उन्हें कम करने के लिए स्टैटिक पैटर्न मैचिंग और डायनेमिक सैंडबॉक्स्ड फज़िंग को जोड़ता है।

Charoes Huang, Xin Huang, Amin Milani Fard2026-03-24
💻 computer science

Are AI-assisted Development Tools Immune to Prompt Injection?

यह शोध पत्र सात व्यापक रूप से उपयोग किए जाने वाले मॉडल कॉन्टेक्स्ट प्रोटोकॉल (MCP) क्लाइंट्स में प्रॉम्प्ट इंजेक्शन कमजोरियों का पहला अनुभवजन्य विश्लेषण प्रस्तुत करता है, जो उनकी सुरक्षा स्थितियों में महत्वपूर्ण असमानताओं को प्रकट करता है और टूल-पॉइजनिंग हमलों के विरुद्ध AI-सहायता प्राप्त विकास वर्कफ़्लो को सुरक्षित करने के लिए व्यावहारिक मार्गदर्शन प्रदान करता है।

Charoes Huang, Xin Huang, Amin Milani Fard2026-03-24
💻 computer science

A Curated List of Open-source Software-only Energy Efficiency Measurement Tools: A GitHub Mining Study

यह शोध पत्र ओपन-सोर्स सॉफ्टवेयर-ओनली ऊर्जा दक्षता मापन उपकरणों की पहचान, वर्गीकरण और विश्लेषण करने के लिए गिटहब (GitHub) रिपॉजिटरी की माइनिंग करने वाले एक अनुभवजन्य अध्ययन को प्रस्तुत करता है, जो सीपीयू-केंद्रित उपयोगिताओं से लेकर उत्सर्जन अनुमान क्षमताओं वाले विविध, बहु-स्तरीय निगरानी समाधानों तक उनके विकास को प्रकट करता है।

Manuela Bechara Cannizza, Michel Albonico2026-03-24
🤖 AI

Cross-site scripting adversarial attacks based on deep reinforcement learning: Evaluation and extension study

यह शोध पत्र वैधता खतरों को संबोधित करते हुए और एक XSS ओरेकल (Oracle) पेश करते हुए, XSS डिटेक्टरों के विरुद्ध एक अत्याधुनिक डीप रीइन्फोर्समेंट लर्निंग-आधारित एडवर्सरियल हमले का मूल्यांकन और विस्तार करता है, जिससे अंततः 96% से अधिक की इवेजन दर (evasion rate) प्राप्त होती है।

Samuele Pasini, Gianluca Maragliano, Jinhan Kim, Paolo Tonella2026-03-23
💻 computer science

Defusing Logic Bombs in Symbolic Execution with LLM-Generated Ghost Code

गॉर्डियन (Gordian) एक हाइब्रिड सिम्बोलिक एक्जीक्यूशन फ्रेमवर्क है जो वास्तविक दुनिया के कोड के विश्लेषण को बढ़ाने के लिए चुनिलेक्टिव रूप से हल्के घोस्ट कोड (जैसे कि इनवर्शन्स, सरोगेट्स और हीप पार्टिशन्स) उत्पन्न करने के लिए LLMs का उपयोग करता है, जो लॉजिक बमों और जटिल तर्क चुनौतियों से निपटने में SMT सॉल्वर की सहायता करते हैं, जिससे शुद्ध LLM-आधारित दृष्टिकोणों की तुलना में टोकन के उपयोग को नाटकीय रूप से कम करते हुए कवरेज में महत्वपूर्ण सुधार होता है।

Dimitrios Stamatios Bouras, Sergey Mechtaev2026-03-23
🤖 AI

Goedel-Code-Prover: Hierarchical Proof Search for Open State-of-the-Art Code Verification

यह शोध पत्र Goedel-Code-Prover को प्रस्तुत करता है, जो Lean 4 के लिए एक पदानुक्रमित (hierarchical) प्रूफ़ सर्च फ्रेमवर्क है, जो कोड सत्यापन बेंचमार्क पर 62.0% सफलता दर प्राप्त करने के लिए हाइब्रिड सुदृढीकरण शिक्षण (reinforcement learning) और एक सिद्धांत-आधारित अपघटन स्कोर (decomposition score) के साथ प्रशिक्षित एक एकीकृत 8B-पैरामीटर मॉडल का उपयोग करता है, जो कुशल, स्केलेबल प्रूफ़ प्लानिंग के माध्यम से बड़े बेसलाइन्स से काफी बेहतर प्रदर्शन करता है।

Zenan Li (Mike), Ziran Yang (Mike), Deyuan (Mike), He, Haoyu Zhao, Andrew Zhao, Shange Tang, Kaiyu Yang, Aarti Gupta (…)2026-03-23
💻 computer science

DePro: Understanding the Role of LLMs in Debugging Competitive Programming Code

यह शोध पत्र DePro को प्रस्तुत करता है, जो एक टेस्ट-केस संचालित फ्रेमवर्क है जो स्ट्रेस टेस्टिंग और ब्रूट-फोर्स रेफरेंस जनरेशन के माध्यम से दोषपूर्ण कॉम्पिटिटिव प्रोग्रामिंग कोड को पुनरावृत्ति रूप से परिष्कृत करने के लिए LLMs का लाभ उठाता है, जो मानव और ज़ीरो-शॉट LLM दृष्टिकोणों की तुलना में डिबगिंग समय और प्रयासों में महत्वपूर्ण कमी प्रदर्शित करता है।

Nabiha Parvez, Tanvin Sarkar Pallab, Mia Mohammad Imran, Tarannum Shaila Zaman2026-03-23
🤖 AI

Skilled AI Agents for Embedded and IoT Systems Development

यह शोध पत्र हार्डवेयर-इन-द-लूप एम्बेडेड विकास की चुनौतियों को संबोधित करने के लिए एक कौशल-आधारित एजेंटिक फ्रेमवर्क और IoT-SkillsBench बेंचमार्क प्रस्तुत करता है, जो यह प्रदर्शित करता है कि संक्षिप्त, मानव-विशेषज्ञ कौशलों को शामिल करने से विविध वास्तविक दुनिया के IoT प्लेटफॉर्म्स पर AI एजेंट की सफलता दर में महत्वपूर्ण सुधार होता है।

Yiming Li, Yuhan Cheng, Mingchen Ma, Yihang Zou, Ningyuan Yang, Wei Cheng, Hai "Helen" Li, Yiran Chen, Tingjun Chen2026-03-23
💻 computer science

GazePrinter: Visualizing Expert Gaze to Guide Novices in a New Codebase

यह शोध पत्र GazePrinter को प्रस्तुत करता है, जो विशेषज्ञों के दृष्टि पैटर्न (gaze patterns) को विज़ुअलाइज़ करने वाला एक उपकरण है ताकि नए कोडबेस के माध्यम से नौसिखियों का मार्गदर्शन किया जा सके, और 40 प्रतिभागियों के साथ एक मिश्रित-पद्धति अध्ययन के माध्यम से यह प्रदर्शित करता है कि यह दृष्टिकोण नौसिखियों को विशेषज्ञ-समान नेविगेशन पथों का अनुसरण करने में मदद करता है और संभावित रूप से उनके समय और संज्ञानात्मक भार (cognitive load) को कम करता है।

Peng Kuang, Emma Söderberg, April Yi Wang, Martin Höst2026-03-23
🤖 AI

Revealing Domain-Spatiality Patterns for Configuration Tuning: Domain Knowledge Meets Fitness Landscapes

यह शोध पत्र डोमलैंड (Domland) प्रस्तुत करता है, जो एक ऐसी कार्यप्रणाली है जो फिटनेस लैंडस्केप विश्लेषण (Fitness Landscape Analysis) को डोमेन ज्ञान के साथ जोड़ती है ताकि सिस्टम-विशिष्ट विशेषताओं, मुख्य विकल्पों और वर्कलोड्स के माध्यम से ट्यूनिंग की कठिनाई को प्रकट करते हुए कॉन्फ़िगरेशन ट्यूनर्स की प्रभावशीलता को व्यवस्थित रूप से समझाया जा सके।

Yulong Ye, Hongyuan Liang, Chao Jiang, Miqing Li, Tao Chen2026-03-23