🤖 AI

Detect, Localize, and Explain: Interactive Hierarchical Log Anomaly Analytics with LLM Augmentation

यह शोध पत्र Krone-viz प्रस्तुत करता है, जो एक संवादात्मक विज़ुअलाइज़ेशन सिस्टम है जो चयनात्मक LLM संवर्धन (augmentation) और मानव-इन-द-लूप परिशोधन के माध्यम से सटीक विसंगति का पता लगाने, स्थानीयकरण करने और स्पष्टीकरण करने में सक्षम बनाने के लिए एक नवीन पदानुक्रमित लॉग एब्स्ट्रैक्शन और मॉड्यूलर ऑर्केस्ट्रेशन फ्रेमवर्क का लाभ उठाता है।

Lei Ma, Suhani Chaudhary, Ethan Shanbaum, Athanasios Tassiadamis, Peter M. VanNostrand, Dennis M. Hofmann, Haowen Xu, El (…)2026-05-12
⚛️ quantum physics

Scaling Qubit Mapping and Routing With Position Graph Abstraction and Memoization

यह शोध पत्र ट्रैप्ड-आयन QCCD आर्किटेक्चर के लिए एक संकलन फ्रेमवर्क (compilation framework) प्रस्तुत करता है जो निर्णय की गुणवत्ता को संरक्षित करते हुए अनावश्यक गणनाओं को समाप्त करके क्यूबिट मैपिंग और रूटिंग के लिए SABRE ह्यूरिस्टिक सर्च को महत्वपूर्ण रूप से तेज करने हेतु एक पोजीशन ग्राफ एब्स्ट्रैक्शन और मेमोइज़ेशन तकनीकों का लाभ उठाता है।

Brent Russon, Bao Bach, Ed Younis, Ilya Safro2026-05-12
💻 computer science

Generating Complex Code Analyzers from Natural Language Questions

यह शोध पत्र Merlin को प्रस्तुत करता है, जो एक नवीन RAG-आधारित पुनरावृत्ति जनन (iterative generation) और स्व-परीक्षण दृष्टिकोण का उपयोग करके बड़े कोडबेस के बारे में जटिल प्राकृतिक भाषा संबंधी प्रश्नों के उत्तर देने के लिए लार्ज लैंग्वेज मॉडल्स को CodeQL प्रोग्राम विश्लेषण ढांचे के साथ जोड़ता है, जिससे डेवलपर कार्य की सटीकता और दक्षता में महत्वपूर्ण सुधार होता है।

Amirmohammad Nazari, Sadra Sabouri, Wang Bill Zhu, Robin Jia, Souti Chattopadhyay, Mukund Raghothaman2026-05-12
🤖 AI

SmartEval: A Benchmark for Evaluating LLM-Generated Smart Contracts from Natural Language Specifications

यह शोध पत्र SmartEval को प्रस्तुत करता है, जो 9,000 LLM-जनित सॉलिडिटी (Solidity) अनुबंधों के एक संग्रह, एक पांच-आयामी मूल्यांकन मानदंड और एक प्रमाणित पाइपलाइन से युक्त एक व्यापक बेंचमार्क है, जो विशिष्ट विफलता मोड को प्रकट करता है और यह प्रदर्शित करता है कि LLM-जनित अनुबंध कार्यात्मक अनुपालन में ग्राउंड-ट्रुथ कार्यान्वयन से बेहतर प्रदर्शन कर सकते हैं।

Abhinav Goel, Agostino Capponi, Alfio Gliozzo, Chaitya Shah2026-05-12
🤖 AI

Combining Mechanical and Agentic Specification Inference for Move

यह शोध पत्र मूव प्रोवर (Move Prover) के लिए एक स्पेसिफिकेशन इन्फरेंस टूल प्रस्तुत करता है जो वेरिफिकेशन स्पेसिफिकेशन्स को स्वचालित रूप से उत्पन्न करने और परिष्कृत करने के लिए साउंड वीकेस्ट-प्रीकंडीशन (weakest-precondition) विश्लेषण को एक एजेंटिक कोडिंग CLI के साथ समन्वित करता है, जो लूप इनवैरिएंट्स (loop invariants) और स्ट्रक्चरल इनवैरिएंट्स (structural invariants) जैसी जटिल प्रॉपर्टीज को संभालते हुए मैन्युअल बॉयलरप्लेट को प्रभावी ढंग से कम करता है।

Wolfgang Grieskamp, Teng Zhang, Vineeth Kashyap2026-05-12
🤖 AI

Beyond Autonomy: A Dynamic Tiered AgentRunner Framework for Governable and Resilient Enterprise AI Execution

यह शोध पत्र डायनेमिक टियर्ड एजेंटरनर (Dynamic Tiered AgentRunner) का प्रस्ताव करता है, जो एक ऐसा ढांचा है जिसे जोखिम-अनुकूलित संसाधन आवंटन, पृथक एजेंटों के साथ शक्तियों के पृथक्करण वाली वास्तुकला और वर्तमान स्वायत्त एजेंट प्रणालियों में शासन की कमी को दूर करने के लिए एक विफलता-सहनशील सत्यापन लूप को लागू करके एंटरप्राइज एआई सुरक्षा और लचीलेपन को बढ़ाने के लिए डिज़ाइन किया गया है।

Kai Pan, Rong Hou2026-05-12
🤖 machine learning

MARGIN: Margin-Aware Regularized Geometry for Imbalanced Vulnerability Detection

यह शोध पत्र MARGIN का प्रस्ताव करता है, जो एक मीट्रिक-आधारित ढांचा है जो एडेप्टिव मार्जिन मीट्रिक लर्निंग और हाइपरस्फेरिकल प्रोटोटाइप मॉडलिंग का लाभ उठाकर सॉफ्टवेयर भेद्यता (वल्नरेबिलिटी) डिटेक्शन में फ्रीक्वेंसी और कठिनाई के असंतुलन को संबोधित करता है ताकि एम्बेडिंग स्पेस में ज्यामितीय विकृतियों को सुधारा जा सके, जिससे असंतुलित डेटासेट पर बेहतर वर्गीकरण प्रदर्शन और मजबूती प्राप्त की जा सके।

Yuteng Zhang, Huifang Ma, Jiahui Wei, Qingqing Li, Yafei Yang2026-05-12
🔬 physics

DREAMS: Modelling Support for Research into Engineering and Artistic Design

यह शोध पत्र DREAMS प्रस्तुत करता है, जो एक प्रोटोटाइप मॉडलिंग वातावरण है जिसे डिज़ाइन रिसर्च मेथोडोलॉजी (DRM) मॉडलों के निर्माण, रखरखाव और ट्रैसेबिलिटी को स्वचालित और सुव्यवस्थित करने के लिए डिज़ाइन किया गया है, जो प्रारंभिक मूल्यांकन के माध्यम से यह प्रदर्शित करता है कि यह मैन्युअल प्रथाओं की तुलना में मॉडलिंग प्रयास को काफी कम करता है और सूचना पुनर्प्राप्ति में सुधार करता है।

Apala Chakrabarti2026-05-12
🤖 AI

CrackMeBench: Binary Reverse Engineering for Agents

यह शोधपत्र CrackMeBench प्रस्तुत करता है, जो एक नवीन बेंचमार्क है जिसे शैक्षिक CrackMe-शैली की चुनौतियों के लिए वैलिडेशन लॉजिक को रिकवर करने और वैध इनपुट जेनरेट करने हेतु बाइनरी रिवर्स इंजीनियरिंग को स्वायत्त रूप से करने में लैंग्वेज-मॉडल एजेंटों की क्षमताओं का मूल्यांकन करने के लिए डिज़ाइन किया गया है, जो सार्वजनिक और जेनरेटेड दोनों कार्यों पर विभिन्न मॉडलों के बीच सफलता के विविध स्तरों को प्रदर्शित करता है।

Isaac David, Arthur Gervais2026-05-12
🤖 AI

ComplexMCP: Evaluation of LLM Agents in Dynamic, Interdependent, and Large-Scale Tool Sandbox

यह शोध पत्र ComplexMCP को प्रस्तुत करता है, जो मॉडल कॉन्टेक्स्ट प्रोटोकॉल (Model Context Protocol) पर आधारित एक कठोर बेंचमार्क है जिसमें 300 से अधिक परस्पर निर्भर उपकरण और गतिशील पर्यावरणीय सिमुलेशन शामिल हैं, जो यह प्रकट करता है कि वर्तमान LLM एजेंट जटिल वर्कफ़्लो में मनुष्यों की तुलना में काफी कम प्रदर्शन करते हैं क्योंकि वे टूल रिट्रीवल सैचुरेशन (tool retrieval saturation), अति-आत्मविश्वास और रणनीतिक पराजयवाद (strategic defeatism) जैसी बाधाओं का सामना करते हैं।

Yuanyang Li, Xue Yang, Longyue Wang, Weihua Luo, Hongyang Chen2026-05-12