💬 NLP

Evaluating and Achieving Controllable Code Completion in Code LLM

यह शोध पत्र कोड LLMs में निर्देश-अनुपालन मूल्यांकन की कमी को दूर करने के लिए कंट्रोलेबल कोड कंप्लीशन बेंचमार्क (C3-Bench) प्रस्तुत करता है, ओपन-सोर्स और प्रोप्रायटरी मॉडल्स के बीच महत्वपूर्ण प्रदर्शन अंतराल को उजागर करता है, और एक डेटा सिंथेसिस पाइपलाइन प्रस्तावित करता है जो एक फाइन-ट्यून्ड मॉडल को इस नए बेंचमार्क पर अत्याधुनिक परिणाम प्राप्त करने में सक्षम बनाता है।

Jiajun Zhang, Zeyu Cui, Lei Zhang, Jian Yang, Jiaxi Yang, Qiang Liu, Zilei Wang, Binyuan Hui, Liang Wang, Junyang Lin2026-01-23
💻 computer science

The Role of Cognitive Abilities in Requirements Inspection: Comparing UML and Textual Representations

यह अध्ययन प्रकट करता है कि आवश्यकताओं के निरीक्षण में UML आरेखों की प्रभावशीलता एकसमान नहीं है बल्कि व्यक्तिगत संज्ञानात्मक क्षमताओं के साथ महत्वपूर्ण रूप से परस्पर क्रिया करती है, जहाँ दृश्य सहायता का उपयोग करते समय उच्च वर्किंग मेमोरी और मेंटल रोटेशन कौशल, उल्लंघन का पता लगाने में कमी लेकिन औचित्य सटीकता में सुधार की ओर ले जाते हैं।

Giovanna Broccia, Sira Vegas, Alessio Ferrari2026-01-23
🤖 AI

Scalable Board Expansion within a General Game System

यह शोध प्रबंध एक जनरल गेम सिस्टम के भीतर एक गतिशील बोर्ड विस्तार तंत्र का प्रस्ताव करता है ताकि खेल के दौरान गेम बोर्ड को स्वचालित रूप से बढ़ाया जा सके, जिससे पारंपरिक स्थिर, अत्यधिक बड़े बोर्डों से जुड़ी अनावश्यक जटिलता को समाप्त किया जा सके।

Clémentine Sacré2026-01-23
🤖 AI

Protocode: Prototype-Driven Interpretability for Code Generation in LLMs

यह शोध पत्र एक प्रोटोटाइप-संचालित दृष्टिकोण का प्रस्ताव करता है जो उच्च-गुणवत्ता वाले इन-कॉन्टेक्स्ट लर्निंग (In-Context Learning) प्रदर्शनों को स्वचालित रूप से नमूना लेने के लिए AST-आधारित विश्लेषण का उपयोग करता है, जिससे कोड जनरेशन कार्यों में लार्ज लैंग्वेज मॉडल्स (Large Language Models) की व्याख्यात्मकता और प्रदर्शन दोनों को एक साथ बढ़ाया जा सके।

Krishna Vamshi Bodla, Haizhao Yang2026-01-22
🤖 AI

Computational Foundations for Strategic Coopetition: Formalizing Trust and Reputation Dynamics

यह शोध पत्र एक गेम-थ्योरी आधारित, दो-स्तरीय विश्वास मॉडल (trust model) को पेश करके गुणात्मक वैचारिक मॉडलिंग और कम्प्यूटेशनल ट्रस्ट विश्लेषण के बीच के अंतर को पाटता है, जिसमें विषम अद्यतन तंत्र (asymmetric updating mechanisms) हैं जो रणनीतिक सह-प्रतिस्पर्धा (strategic coopetition) में गतिशील विश्वास विकास को सफलतापूर्वक पुनरुत्पादित करता है, जैसा कि व्यापक पैरामीटर परीक्षण और रेनॉल्ट-निसान अलायंस के एक ऐतिहासिक केस स्टडी के माध्यम से सत्यापित किया गया है।

Vik Pant, Eric Yu2026-01-22
💻 computer science

Software Testing in the Quantum World

यह शोध पत्र जटिल क्वांटम सॉफ़्टवेयर के सत्यापन के लिए शास्त्रीय सिमुलेशन (classical simulation) की बढ़ती अव्यावहारिकता को संबोधित करते हुए प्रमुख परीक्षण चुनौतियों को रेखांकित करता है और वास्तविक क्वांटम कंप्यूटरों पर सीधे संचालित होने वाले गुणवत्ता आश्वासन विधियों के लिए सॉफ़्टवेयर इंजीनियरिंग परिप्रेक्ष्यों का प्रस्ताव देता है।

Rui Abreu, Shaukat Ali, Paolo Arcaini, Jose Campos, Michael Felderer, Claude Gravel, Fuyuki Ishikawa, Stefan Klikovits (…)2026-01-22
🤖 AI

Tokenomics: Quantifying Where Tokens Are Used in Agentic Software Engineering

यह शोध पत्र LLM-आधारित मल्टी-एजेंट सॉफ्टवेयर इंजीनियरिंग सिस्टम में टोकन खपत के पैटर्न का विश्लेषण करता है, जो यह प्रकट करता है कि पुनरावृत्ति कोड समीक्षा चरण और इनपुट टोकन संसाधन उपयोग पर हावी हैं, जिससे यह स्पष्ट होता है कि प्राथमिक लागत प्रारंभिक कोड जनरेशन के बजाय स्वचालित परिशोधन और सत्यापन में निहित है।

Mohamad Salim, Jasmine Latendresse, SayedHassan Khatoonabadi, Emad Shihab2026-01-22
🤖 AI

Implementing Knowledge Representation and Reasoning with Object Oriented Design

यह शोध पत्र KRROOD प्रस्तुत करता है, जो ज्ञान को एक प्रथम-श्रेणी के एब्स्ट्रैक्शन (first-class abstraction) के रूप में मानकर नॉलेज रिप्रेजेंटेशन एंड रीजनिंग को ऑब्जेक्ट-ओरिएंटेड डिज़ाइन के साथ एकीकृत करता है, जिससे लॉजिक प्रोग्रामिंग और आधुनिक सॉफ्टवेयर इंजीनियरिंग के बीच के अंतर को पाटते हुए बेंचमार्क और वास्तविक दुनिया के स्वायत्त परिदृश्यों पर मजबूत प्रदर्शन का प्रदर्शन किया गया है।

Abdelrhman Bassiouny, Tom Schierenbeck, Sorin Arion, Benjamin Alt, Naren Vasantakumaar, Giang Nguyen, Michael Beetz2026-01-22
🤖 machine learning

HyperNet-Adaptation for Diffusion-Based Test Case Generation

यह शोध पत्र HyNeA प्रस्तुत करता है, जो एक डेटासेट-मुक्त जनरेटिव टेस्टिंग विधि है जो हाइपरनेटवर्क्स का लाभ उठाती है ताकि बिना किसी विफलता-लेबल वाले प्रशिक्षण डेटा या महंगे फाइन-ट्यूनिंग की आवश्यकता के, यथार्थवादी विफलता-प्रेरित परीक्षण मामले (failure-inducing test cases) उत्पन्न करने के लिए डिफ्यूजन मॉडल्स पर कुशल, इंस्टेंस-स्तरीय नियंत्रण सक्षम किया जा सके।

Oliver Weißl, Vincenzo Riccio, Severin Kacianka, Andrea Stocco2026-01-22
🤖 machine learning

SmartOracle -- An Agentic Approach to Mitigate Noise in Differential Oracles

स्मार्टओरेकल (SmartOracle) एक एजेंटिक फ्रेमवर्क पेश करता है जो जावास्क्रिप्ट फज़िंग के लिए डिफरेंशियल ओरेकल की सटीकता को स्वचालित और उन्नत करने के लिए विशिष्ट लार्ज लैंग्वेज मॉडल सब-एजेंटों का लाभ उठाता है, जो मैन्युअल प्रयास, लागत और फॉल्स पॉजिटिव्स को काफी कम करता है और प्रमुख इंजनों में पहले से अज्ञात स्पेसिफिकेशन-लेवल बग्स को सफलतापूर्वक पहचानने में सक्षम है।

Srinath Srinivasan, Tim Menzies, Marcelo D'Amorim2026-01-22