💻 computer science

Semantic Tool Discovery for Large Language Models: A Vector-Based Approach to MCP Tool Selection

यह शोध पत्र मॉडल कॉन्टेक्स्ट प्रोटोकॉल (MCP) के लिए एक वेक्टर-आधारित सिमेंटिक टूल डिस्कवरी आर्किटेक्चर पेश करता है जो डेंस एम्बेडिंग्स के माध्यम से केवल सबसे प्रासंगिक टूल्स को गतिशील रूप से चुनकर टोकन ओवरहेड और लेटेंसी को काफी कम कर देता है, जिससे 97.1% हिट रेट बनाए रखते हुए टोकन खपत में 99.6% की कमी आती है।

Sarat Mudunuri, Jian Wan, Ally Qin, Srinivasan Manoharan2026-03-24
💻 computer science

Procedural Refinement by LLM-driven Algorithmic Debugging for ARC-AGI-2

यह शोध पत्र एबडक्शन-बेस्ड प्रोसीजरल रिफाइनमेंट (ABPR) को प्रस्तुत करता है, जो एक न्यूरो-सिम्बोलिक दृष्टिकोण है जो कोड रिपेयर को एक औपचारिक, स्टेपवाइज प्रोसीजरल रिफाइनमेंट प्रक्रिया में बदलकर ARC-AGI-2 बेंचमार्क पर 56.67% का Pass@2 स्कोर प्राप्त करने के लिए एक मेटा-इंटरप्रेटर और उडी शापिरो के एल्गोरिद्मिक प्रोग्राम डिबगिंग सिद्धांत के साथ LLMs को एकीकृत करता है।

Yu-Ning Qiu, Lin-Feng Zou, Jiong-Da Wang, Xue-Rong Yuan, Wang-Zhou Dai2026-03-24
💻 computer science

The Nature of Technical Debt in Research Software

यह शोध पत्र एक बहु-विधि अध्ययन प्रस्तुत करता है जो अनुसंधान सॉफ्टवेयर में स्व-स्वीकृत तकनीकी ऋण (self-admitted technical debt) के नौ अद्वितीय प्रकारों की पहचान करता है और 28,000 कोड टिप्पणियों और शोधकर्ताओं एवं सॉफ्टवेयर इंजीनियरों के साथ साक्षात्कार के विश्लेषण के माध्यम से इसके प्रबंधन को प्रभावित करने वाले चार प्रमुख विषयों का अन्वेषण करता है।

Neil A. Ernst, Ahmed Musa Awon, Swapnil Hingmire, Ze Shi Li2026-03-24
💻 computer science

yProv4DV: Reproducible Data Visualization Scripts Out of the Box

यह शोध पत्र yProv4DV को प्रस्तुत करता है, जो एक हल्का पायथन लाइब्रेरी है जो न्यूनतम कोड संशोधनों के साथ इनपुट, आउटपुट और सोर्स कोड को स्वचालित रूप से ट्रैक करके पुनरुत्पादक डेटा विज़ुअलाइज़ेशन को सक्षम बनाता है, जिससे वैज्ञानिक अनुसंधान के भीतर प्लॉट्स को पुनरुत्पादित करने में मौजूद अंतराल को संबोधित किया जा सके।

Gabriele Padovani, Sandro Fiore2026-03-24
💻 computer science

Software Entropy: A Statistical Mechanics Framework for Software Testing

यह शोध पत्र टेस्ट सूट्स को प्रोग्राम स्पेस पर मैक्रोस्कोपिक बाधाओं (macroscopic constraints) के रूप में व्याख्या करने के लिए सांख्यिकीय यांत्रिकी (statistical mechanics) के सिद्धांतों को लागू करके, सॉफ्टवेयर एंट्रॉपी को मापने के लिए एक औपचारिक ढांचे का प्रस्ताव करता है, जिसमें एंट्रॉपी का अनुभवजन्य अनुमान लगाने के लिए म्यूटेशन विश्लेषण का उपयोग किया गया है और यह प्रदर्शित किया गया है कि कैसे सूचना-भारित मेट्रिक्स उन संरचनात्मक अंतर्दृष्टियों को प्रकट करते हैं जिन्हें पारंपरिक कवरेज माप चूक जाते हैं।

Jerónimo Fotinós, Juan B. Cabral2026-03-24
💻 computer science

LogFold: Compressing Logs with Structured Tokens and Hybrid Encoding

LogFold एक नवीन लॉग संपीड़न (log compression) विधि है जो संरचित टोकन में नए रेडंडेंसी पैटर्न की पहचान करके और एक टाइप-अवेयर हाइब्रिड एनकोडिंग रणनीति को नियोजित करके अत्याधुनिक बेसलाइन में सुधार करती है, जिससे 16 सार्वजनिक डेटासेटों में संपीड़न अनुपात (compression ratio) में औसतन 11.11% का सुधार प्राप्त होता है।

Shiwen Shan, Yintong Huo, Hongzhan Zhong, Zhining Wang, Yuxin Su, Zibin Zheng2026-03-24
🤖 AI

AEGIS: From Clues to Verdicts -- Graph-Guided Deep Vulnerability Reasoning via Dialectics and Meta-Auditing

AEGIS एक नवीन मल्टी-एजेंट फ्रेमवर्क है जो LLM तर्क को रिपॉजिटरी-स्तरीय कोड प्रॉपर्टी ग्राफ में ग्राउंड करके साक्ष्य-आधारित डिपेंडेंसी चेन को गतिशील रूप से पुनर्गठित करता है, जिससे द्वंद्वात्मक तर्क और स्वतंत्र मेटा-ऑडिटिंग के माध्यम से मतिभ्रम (hallucinations) को समाप्त करते हुए अत्याधुनिक भेद्यता पहचान (vulnerability detection) प्राप्त करता है।

Sen Fang, Weiyuan Ding, Zhezhen Cao, Zhou Yang, Bowen Xu2026-03-24
💻 computer science

Engineering Pitfalls in AI Coding Tools: An Empirical Study of Bugs in Claude Code, Codex, and Gemini CLI

यह शोध पत्र Claude Code, Codex और Gemini CLI के माध्यम से 3,800 से अधिक GitHub बग्स का व्यवस्थित विश्लेषण करके AI-सहायता प्राप्त कोडिंग टूल्स में इंजीनियरिंग कमियों (pitfalls) का पहला अनुभवजन्य अध्ययन प्रस्तुत करता है, जो यह प्रकट करता है कि कार्यात्मक मुद्दे और API/एकीकरण त्रुटियां विफलताओं के प्राथमिक कारण हैं जो मुख्य रूप से टूल के आह्वान (invocation) और कमांड निष्पादन को बाधित करते हैं।

Ruixin Zhang, Wuyang Dai, Hung Viet Pham, Gias Uddin, Jinqiu Yang, Song Wang2026-03-24
💻 computer science

SkillProbe: Security Auditing for Emerging Agent Skill Marketplaces via Multi-Agent Collaboration

यह शोध पत्र SkillProbe को प्रस्तुत करता है, जो एक मल्टी-एजेंट सहयोगात्मक सुरक्षा ऑडिटिंग फ्रेमवर्क है जो LLM एजेंट स्किल मार्केटप्लेसेस में सिमेंटिक-बिहेवियरल विसंगतियों और कॉम्बिनेटोरियल जोखिमों को संबोधित करता है, और बड़े पैमाने पर मूल्यांकन के माध्यम से यह प्रकट करता है कि उच्च लोकप्रियता सुरक्षा की गारंटी नहीं देती है और व्यवस्थित कैस्केड जोखिम एक विशाल कनेक्टेड कंपोनेंट (giant connected component) का निर्माण करते हैं।

Zihan Guo, Zhiyu Chen, Xiaohang Nie, Jianghao Lin, Yuanjian Zhou, Weinan Zhang2026-03-24
💻 computer science

Zero-Shot Vulnerability Detection in Low-Resource Smart Contracts Through Solidity-Only Training

यह शोध पत्र Sol2Vy को प्रस्तुत करता है, जो एक नवीन ढांचा (framework) है जो विशेष रूप से सॉलिडिटी (Solidity) पर प्रशिक्षित मॉडलों से ज्ञान स्थानांतरित करके कम-संसाधन वाले वाइपर (Vyper) स्मार्ट कॉन्ट्रैक्ट्स में ज़ीरो-शॉट भेद्यता (zero-shot vulnerability) का पता लगाने में सक्षम बनाता है, जिससे वाइपर के लेबल वाले डेटासेट की कमी दूर होती है और मौजूदा अत्याधुनिक (state-of-the-art) विधियों से बेहतर प्रदर्शन होता है।

Minghao Hu, Qiang Zeng, Lannan Luo2026-03-24