💬 NLP

Argus: Reorchestrating Static Analysis via a Multi-Agent Ensemble for Full-Chain Security Vulnerability Detection

यह शोध पत्र Argus को प्रस्तुत करता है, जो एक नवीन मल्टी-एजेंट फ्रेमवर्क है जो आपूर्ति श्रृंखला विश्लेषण (सप्लाई चेन एनालिसिस), सहयोगी एजेंटों और RAG एवं ReAct जैसी उन्नत तकनीकों को एकीकृत करके स्टेटिक एनालिसिस वर्कफ़्लो को पुनर्गठित करता है ताकि वास्तविक कमजोरियों का पता लगाने में मौजूदा LLM-आधारित तरीकों से काफी बेहतर प्रदर्शन करते हुए फॉल्स पॉजिटिव्स और परिचालन लागत को कम किया जा सके।

Zi Liang, Qipeng Xie, Jun He, Bohuan Xue, Weizheng Wang, Yuandao Cai, Fei Luo, Boxian Zhang, Haibo Hu, Kaishun Wu2026-04-09
💻 computer science

Benchmarking Requirement-to-Architecture Generation with Hybrid Evaluation

यह शोध पत्र R2ABench प्रस्तुत करता है, जो PRDs और विशेषज्ञ PlantUML आरेखों के साथ वास्तविक दुनिया की परियोजनाओं वाला एक नया बेंचमार्क है, साथ ही एक हाइब्रिड मूल्यांकन ढांचा भी प्रदान करता है जो यह प्रकट करता है कि जबकि LLMs सिंटैक्स और एंटिटी एक्सट्रैक्शन में उत्कृष्ट हैं, वे सॉफ्टवेयर आर्किटेक्चर जनरेशन में रिलेशनल रीजनिंग (संबंधात्मक तर्क) के साथ मौलिक रूप से संघर्ष करते हैं।

Minxiao Li, Shuying Yan, Li Zhang, Yang Liu, Fang Liu2026-04-09
💻 computer science

Stabilization Without Simplification: A Two-Dimensional Model of Software Evolution

यह शोध पत्र एक द्वि-आयामी संभाव्यता ढांचे को प्रस्तुत करता है जो यह प्रदर्शित करता है कि कैसे सॉफ्टवेयर सिस्टम अपेक्षित परिवर्तन प्रयास और उसके विचरण के बीच अंतर करके सरलीकरण (कम संरचनात्मक बोझ) के बिना स्थिरीकरण (अनिश्चितता में कमी) प्राप्त कर सकते हैं।

Masaru Furukawa2026-04-09
⚛️ quantum physics

Broken Quantum: A Systematic Formal Verification Study of Security Vulnerabilities Across the Open-Source Quantum Computing Simulator Ecosystem

यह शोध पत्र "ब्रोकन क्वांटम" (Broken Quantum) प्रस्तुत करता है, जो COBALT QAI इंजन और Z3 सॉल्वर का उपयोग करके 45 ओपन-सोर्स क्वांटम कंप्यूटिंग सिम्युलेटर्स का पहला व्यापक औपचारिक सुरक्षा ऑडिट है, जिसने एक नवीन क्वांटम-विशिष्ट हमला वेक्टर सहित 547 महत्वपूर्ण कमजोरियों की पहचान की और एक वाणिज्यिक फ्रेमवर्क से अमेरिकी राष्ट्रीय प्रयोगशाला बुनियादी ढांचे तक पहले आपूर्ति श्रृंखला भेद्यता हस्तांतरण को प्रलेखित किया।

Dominik Blain2026-04-09
💻 computer science

Fine-grained Approaches for Confidence Calibration of LLMs in Automated Code Revision

यह शोध पत्र स्वचालित कोड संशोधन कार्यों में कॉन्फिडेंस स्कोर को कैलिब्रेट करने के लिए एक फाइन-ग्रेन्ड लोकल प्लैट-स्केलिंग दृष्टिकोण का प्रस्ताव और सत्यापन करता है, जो यह प्रदर्शित करता है कि यह विविध मॉडलों और मेट्रिक्स में पारंपरिक ग्लोबल विधियों की तुलना में काफी बेहतर प्रदर्शन करता है क्योंकि यह कॉन्फिडेंस को उन लोकल एडिट निर्णयों के साथ बेहतर ढंग से संरेखित करता है जो कोड की शुद्धता निर्धारित करते हैं।

Hong Yi Lin, Chunhua Liu, Haoyu Gao, Patanamon Thongtanunam, Christoph Treude2026-04-09
💻 computer science

Babbling Suppression: Making LLMs Greener One Token at a Time

यह शोध पत्र 'बबलिंग सप्रेशन' (Babbling Suppression) को प्रस्तुत करता है, जो एक मॉडल-अज्ञेय (model-agnostic) विधि है जो समाधान पास होने पर LLM कोड जनरेशन को समाप्त करने के लिए टेस्ट निष्पादन को एकीकृत करती है, जिससे सटीकता से समझौता किए बिना ऊर्जा की खपत और अनावश्यक टोकन आउटपुट को काफी कम किया जा सकता है।

Lola Solovyeva, Fernando Castor2026-04-09
💻 computer science

Determinacy with Priorities up to Clocks

यह शोध पत्र प्राथमिकता-रक्षित क्रियाओं (priority-guarded actions) और क्लॉक (clocks) के साथ CCS के एक विस्तार का प्रस्ताव करता है ताकि "सुसंगतता" (coherence) की एक नई अवधारणा पेश की जा सके, जिससे एस्टरेल (Esterel) जैसी सिंक्रोनस प्रोग्रामिंग भाषाओं का कंपोजिशनल एनकोडिंग सक्षम हो सके और तुल्यता (concurrency) को नियतता (determinacy) के साथ इस तरह से सुसंगत बनाया जा सके जैसा मिलनर (Milner) का मूल कन्फ्लुएंस सिद्धांत नहीं कर सका।

Luigi Liquori (Centre Inria de l'Université Côte d'Azur), Michael Mendler (University of Bamberg), Claude Stolze (Univer (…)2026-04-09
💻 computer science

Chatbot-Based Assessment of Code Understanding in Automated Programming Assessment Systems

यह शोध पत्र संवादात्मक मूल्यांकन दृष्टिकोणों की एक संतृप्ति-आधारित समीक्षा (saturation-based review) आयोजित करके और एक हाइब्रिड सोक्रेटिक फ्रेमवर्क (Hybrid Socratic Framework) प्रस्तावित करके, जो शैक्षणिक अखंडता सुनिश्चित करने के लिए नियतात्मक कोड विश्लेषण को दोहरी-एजेंट संवादात्मक सत्यापन के साथ एकीकृत करता है, लार्ज लैंग्वेज मॉडल्स के युग में छात्र कोड समझ को सत्यापित करने की चुनौती को संबोधित करता है।

Eduard Frankford, Erik Cikalleshi, Ruth Breu2026-04-09
💬 NLP

CodeMind: Evaluating Large Language Models for Code Reasoning

यह शोधपत्र CodeMind प्रस्तुत करता है, जो एक ऐसा ढांचा है जो तीन विशिष्ट कार्यों—स्वतंत्र निष्पादन (Independent Execution), विनिर्देश (Specification), और गतिशील अर्थ विज्ञान तर्क (Dynamic Semantics Reasoning)—के माध्यम से बड़े भाषा मॉडलों की कोड तर्क क्षमताओं का मूल्यांकन करता है, जिससे यह पता चलता है कि हालांकि मॉडल बुनियादी गतिशील पहलुओं को संभाल सकते हैं, लेकिन जटिलता बढ़ने के साथ उनका प्रदर्शन घट जाता है और बग सुधार क्षमताओं के साथ उनका कोई सहसंबंध नहीं दिखता है।

Changshu Liu, Yang Chen, Reyhaneh Jabbarvand2026-04-08
🤖 AI

TransAgent: Enhancing LLM-Based Code Translation via Fine-Grained Execution Alignment

TransAgent एक नवीन मल्टी-एजेंट सिस्टम है जो डेटा लीकेज को कम करने के लिए डिज़ाइन किए गए एक नए निर्मित बेंचमार्क पर मौजूदा तरीकों की तुलना में महत्वपूर्ण प्रदर्शन सुधार प्राप्त करते हुए, त्रुटियों को स्थानीयकृत और समाप्त करने के लिए फाइन-ग्रेंड निष्पादन संरेखण (fine-grained execution alignment) का उपयोग करके LLM-आधारित कोड अनुवाद को बढ़ाता है।

Zhiqiang Yuan, Weitong Chen, Hanlin Wang, Xin Peng, Zhenpeng Chen, Yiling Lou2026-04-08