💻 computer science

Theory of Troubleshooting: The Developer's Cognitive Experience of Overcoming Confusion

यह शोध पत्र संज्ञानात्मक विज्ञान-आधारित 'ट्रबलशूटिंग के सिद्धांत' (Theory of Troubleshooting) को प्रस्तुत करता है, जो 27 डेवलपर्स के साक्षात्कार से व्युत्पन्न है, जो यह स्पष्ट करता है कि अप्रत्याशित सिस्टम व्यवहारों को मॉडल करने के लिए आवश्यक गहन मानसिक प्रयास किस प्रकार संज्ञानात्मक संसाधनों को समाप्त कर थकान की ओर ले जाता है, जिससे सॉफ्टवेयर विकास में स्थिरता संबंधी जोखिमों को संबोधित करने के लिए एक रूपरेखा प्राप्त होती है।

Arty Starr, Margaret-Anne Storey2026-02-18
🤖 AI

GenAI for Systems: Recurring Challenges and Design Principles from Software to Silicon

यह शोध पत्र सॉफ्टवेयर, आर्किटेक्चर और चिप डिज़ाइन के माध्यम से अनुसंधान को संश्लेषित करता है ताकि सिस्टम में जनरेटिव एआई (Generative AI) को लागू करने में पांच आवर्ती चुनौतियों और पांच अभिसरण सिद्धांतों को प्रकट किया जा सके, और क्रॉस-कम्युनिटी प्रगति को बढ़ावा देने के लिए एक एकीकृत चुनौती-सिद्धांत मानचित्र और साझा इंजीनियरिंग पद्धति का प्रस्ताव दिया जा सके।

Arya Tschand, Chenyu Wang, Zishen Wan, Andrew Cheng, Ioana Cristescu, Kevin He, Howard Huang, Alexander Ingare, Akseli K (…)2026-02-18
🔢 mathematics

MMPersistence: A mathematical morphology-oriented software library for computing persistent homology on cubical complexes

यह शोधपत्र MMPersistence का परिचय देता है, जो एक सॉफ्टवेयर लाइब्रेरी है जो डिजिटल छवियों से बहुस्तरीय टोपोलॉजिकल विशेषताओं को निकालने के लिए विविध स्ट्रक्चरिंग एलिमेंट्स का लाभ उठाते हुए क्यूबिकल कॉम्प्लेक्स पर मैथमेटिकल मॉर्फोलॉजी ऑपरेशन्स को पर्सिस्टेंट होमोलॉजी के साथ एकीकृत करती है ताकि अधिक समृद्ध ज्यामितीय और टोपोलॉजिकल विश्लेषण किया जा सके।

Chuan-Shen Hu2026-02-18
💻 computer science

Req2Road: A GenAI Pipeline for SDV Test Artifact Generation and On-Vehicle Execution

यह शोध पत्र "Req2Road" प्रस्तुत करता है, जो एक GenAI-संचालित पाइपलाइन है जो लार्ज और विजन-लैंग्वेज मॉडल्स को रिट्रीवल-ऑगमेंटेड जनरेशन के साथ जोड़कर सॉफ्टवेयर-डिफाइंड वाहनों के लिए प्राकृतिक भाषा आवश्यकताओं को स्वचालित रूप से निष्पादन योग्य गेरकिन (Gherkin) परिदृश्यों और टेस्ट स्क्रिप्ट में परिवर्तित करता है, जो सिमुलेशन और वास्तविक-वाहन वातावरण में चाइल्ड प्रेजेंस डिटेक्शन सिस्टम की आवश्यकताओं को परिवर्तित करने में 89% सफलता दर प्रदर्शित करता है।

Denesa Zyberaj, Lukasz Mazur, Pascal Hirmer, Nenad Petrovic, Marco Aiello, Alois Knoll2026-02-18
💻 computer science

A Differential Fuzzing-Based Evaluation of Functional Equivalence in LLM-Generated Code Refactorings

यह शोध पत्र पूर्व-निर्धारित परीक्षण मामलों के बिना, एलएलएम (LLM) द्वारा जनरेट किए गए कोड रिफैक्टरिंग में कार्यात्मक तुल्यता का मूल्यांकन करने के लिए एक डिफरेंशियल फज़िंग-आधारित दृष्टिकोण प्रस्तुत करता है, जो यह प्रकट करता है कि वर्तमान मॉडल अक्सर अर्थ संबंधी रूप से भिन्न कोड उत्पन्न करते हैं और मौजूदा परीक्षण सुइट्स अक्सर इन महत्वपूर्ण त्रुटियों का पता लगाने में विफल रहते हैं।

Simantika Bhattacharjee Dristi, Matthew B. Dwyer2026-02-18
🤖 AI

Automated Proof Generation for Rust Code via Self-Evolution

यह शोध पत्र SAFE को प्रस्तुत करता है, जो एक स्व-विकसित (self-evolving) फ्रेमवर्क है जो पुनरावृत्ति डेटा जनरेशन और सिम्बोलिक वेरीफायर द्वारा निर्देशित स्व-डिबगिंग के माध्यम से रस्ट (Rust) कोड के लिए औपचारिक प्रमाणों (formal proofs) को संश्लेषित और परिष्कृत करता है, जिससे ओपन-सोर्स मॉडल स्वचालित प्रमाण जनरेशन में 52.52% सटीकता दर प्राप्त करने में सक्षम होते हैं—जो GPT-4o की 14.39% दर की तुलना में एक महत्वपूर्ण सुधार है।

Tianyu Chen, Shuai Lu, Shan Lu, Yeyun Gong, Chenyuan Yang, Xuheng Li, Md Rakib Hossain Misu, Hao Yu, Nan Duan, Peng Chen (…)2026-02-17
💻 computer science

Simulated Interactive Debugging

यह शोध पत्र "सिम्युलेटेड इंटरएक्टिव डिबगिंग" प्रस्तुत करता है, जो पारंपरिक फॉल्ट लोकलाइजेशन और लार्ज लैंग्वेज मॉडल्स को संयोजित करने वाला एक प्रोटोटाइपिकल सिस्टम है ताकि छात्रों को निर्देशित, इंटरएक्टिव डिबगिंग सहायता प्रदान की जा सके, जिसे इसके व्यवस्थित मार्गदर्शन और स्वचालित ब्रेकपॉइंट फीचर्स के लिए एक लघु-स्तरीय प्रयोग में सकारात्मक रूप से मूल्यांकित किया गया था।

Yannic Noller, Erick Chandra, Srinidhi Chandrashekar, Kenny Choo, Cyrille Jegourel, Oka Kurniawan, Christopher M. Poskit (…)2026-02-17
💬 NLP

EVALOOOP: A Self-Consistency-Centered Framework for Assessing Large Language Model Robustness in Programming

यह शोधपत्र EVALOOOP प्रस्तुत करता है, जो एक नवीन ढांचा है जो कार्यात्मक कोड-प्राकृतिक भाषा रूपांतरणों के औसत सतत लूप (ASL) को मापकर प्रोग्रामिंग में लार्ज लैंग्वेज मॉडल की मजबूती का आकलन करता है, जिससे यह पता चलता है कि बेहतर प्रारंभिक प्रदर्शन वाले मॉडल अनिवार्य रूप से स्व-संदर्भित पुनरावृत्ति कार्यों के तहत अधिक अंतर्निहित स्थिरता प्रदर्शित नहीं करते हैं।

Sen Fang, Weiyuan Ding, Mengshi Zhang, Zihao Chen, Bowen Xu2026-02-17
🤖 AI

Improved Bug Localization with AI Agents Leveraging Hypothesis and Dynamic Cognition

यह शोध पत्र कॉग्नीजेंट (CogniGent) को प्रस्तुत करता है, जो एक नवीन एजेंटिक एआई फ्रेमवर्क है जो सॉफ्टवेयर बग लोकलाइजेशन में मौजूदा पारंपरिक और एलएलएम-आधारित (LLM-based) विधियों से काफी बेहतर प्रदर्शन करने के लिए कॉज़ल रीजनिंग (causal reasoning), कॉल-ग्राफ विश्लेषण और परिकल्पना-संचालित गतिशील संज्ञान (hypothesis-driven dynamic cognition) का लाभ उठाता है।

Asif Mohammed Samir, Mohammad Masudur Rahman2026-02-17
🤖 AI

Debugging code world models

यह शोध पत्र यह पहचानते हुए कि कोड वर्ल्ड मॉडल्स (CWMs) की प्राथमिक विफलता के कारण सघन रनटाइम अवस्थाओं के कारण टोकन-बजट की समाप्ति और स्ट्रिंग्स के साथ सबवर्ड टोकनाइजेशन की समस्याएँ हैं, कोड वर्ल्ड मॉडल्स (CWMs) की सीमाओं का विश्लेषण करता है, साथ ही यह भी प्रदर्शित करता है कि लंबी अवधि की स्टेट ट्रैकिंग त्रुटियाँ मुख्य रूप से गलत एक्शन जनरेशन के कारण होती हैं न कि अंतर्निहित स्टेट प्रोपेगेशन कमजोरियों के कारण।

Babak Rahmani2026-02-17