💻 computer science

Factors Impacting Faculty Adoption of Project-Based Learning in Computing Education: a Survey

80 कंप्यूटिंग संकाय सदस्यों का यह मिश्रित-विधि अध्ययन संस्थागत बाधाओं, नियोजन चुनौतियों और संसाधन सीमाओं को प्रोजेक्ट-आधारित शिक्षण को अपनाने में प्राथमिक अवरोधों के रूप में पहचानता है, जबकि इसके सफल कार्यान्वयन के लिए सहकर्मी सहयोग, व्यावसायिक विकास और उद्योग साझेदारी को महत्वपूर्ण सक्षमकर्ताओं के रूप में रेखांकित करता है।

Ahmad D. Suleiman, Yiming Tang, Daqing Hou2026-07-14
🤖 machine learning

AuditWeave: A Tamper-Evident, Auditor-Navigable Evidence Layer for AI-Assisted and Data-Transformation Workflows

AuditWeave एक हल्का, डिपेंडेंसी-मुक्त पायथन लाइब्रेरी है जो चरणों को एक एकल, हैश-चेन्ड, अपेंड-ओनली लेजर में रिकॉर्ड करके AI-सहायता प्राप्त और डेटा-रूपांतरण वर्कफ़्लो के लिए छेड़छाड़-प्रमाणित अखंडता सुनिश्चित करता है, जिससे ऑडिटर्स विशिष्ट निष्कर्षों को उनके अपरिवर्तित सहायक साक्ष्यों तक ट्रेस करने में सक्षम होते हैं।

Vimal Nakrani2026-07-14
🤖 AI

The Verifier is the Curriculum: Execution-Gated Self-Distillation for Cross-Family Game Generation

यह शोधपत्र यह प्रदर्शित करता है कि सेल्फ-डिस्टिलेशन के लिए एक नियत (deterministic), अनगेमेबल (ungameable) निष्पादन फ़िल्टर (स्ट्रिक्ट-लॉन्च) का उपयोग करना एक कोड जनरेटर की कार्यात्मक, क्रॉस-फैमिली गेम प्रोजेक्ट्स बनाने की क्षमता को महत्वपूर्ण रूप से बढ़ाता है, जो यह सिद्ध करता है कि केवल डेटा की मात्रा या उदार जाँच के बजाय, सत्यापनकर्ता (verifier) की सटीकता ही वास्तविक सामान्यीकरण (generalization) को प्रेरित करती है।

Chenyu Zhou, Qiliang Jiang, Shuning Wu, Xu Zhou2026-07-14
🤖 machine learning

EvoClawBench: Can Agents Learn Reusable Skills from Their Own Runs?

EvoClawBench एक नया बेंचमार्क है जो यह मूल्यांकन करता है कि क्या AI एजेंट अपने स्वयं के निष्पादन (executions) से साक्ष्य को पुन: प्रयोज्य कौशल (reusable skills) में प्रभावी ढंग से परिवर्तित कर सकते हैं, जो यह प्रकट करता है कि ऐसा स्व-शिक्षण स्वचालित प्रदर्शन सुधारों के बजाय अत्यधिक चयनात्मक और रनटाइम-निर्भर परिणाम देता है।

Zhiyuan Peng, Xin Yin, Chenhao Ying, Zhe Cui, Zixiang Ding, Zhenhua Liu, Jiang Wu, Yuan Luo2026-07-14
💻 computer science

Do These Violent Delights Have Violent Ends? Measuring the Post-Merge Fate of Agentic Code

182 रिपॉजिटरीज़ के इस अनुदैर्ध्य (longitudinal) अध्ययन से पता चलता है कि जहाँ एजेंटिक कोड योगदान मानव कोड के तुलनीय मर्ज दरों को प्राप्त करते हैं, वहीं वे बाद में काफी अधिक सुधारात्मक रखरखाव बोझ उत्पन्न करते हैं और अधिक सुरक्षा संबंधी कमजोरियाँ पेश करते हैं, विशेष रूप से कम समीक्षा दरों वाले प्रोजेक्ट्स में।

Chunqiu Steven Xia, Courtney Miller2026-07-14✓ Author reviewed
🤖 AI

A Large-Scale Dataset of MCP Implementations on GitHub

यह शोध पत्र GitHub से 2,297 सत्यापित मॉडल कॉन्टेक्स्ट प्रोटोकॉल (MCP) कार्यान्वयनों का पहला बड़े पैमाने पर, साक्ष्य-आधारित डेटासेट प्रस्तुत करता है, जिसे वास्तविक दुनिया के MCP पारिस्थितिकी तंत्र, विकास प्रवृत्तियों और वास्तुशिल्प पैटर्न का विश्लेषण करने के लिए एक आधारभूत बेंचमार्क स्थापित करने हेतु एक कठोर हाइब्रिड सत्यापन पाइपलाइन के माध्यम से बनाया गया है।

Benny Toeppe, Amine Barrak, Emna Ksontini2026-07-14
🤖 AI

ML in a Box: Analyzing Containerization Practices in Open Source ML Projects

यह शोध पत्र 1,993 ओपन-सोर्स एमएल डॉकरफाइल्स (ML Dockerfiles) के पहले बड़े पैमाने के अनुभवजन्य अध्ययन को प्रस्तुत करता है, जो यह प्रकट करता है कि हालांकि कंटेनर एमएल वर्कफ़्लो में विशिष्ट भूमिकाएँ निभाते हैं, वे अक्सर प्रयोगों द्वारा प्रेरित बार-बार होने वाले पुनर्गठन (rebuilds) के कारण बड़े और अक्षम होते हैं, जिससे बिल्ड दक्षता में सुधार करने और फुटप्रिंट को कम करने के लिए सात विशिष्ट रिफैक्टरिंग पैटर्न की पहचान हुई।

Faten Jebari, Emna Ksontini, Amine Barrak, Wael Kessentini2026-07-14
🤖 machine learning

Knowledge-Conditioned, Single-Pass LLM Synthesis of Executable Unity Game Scenes: A Compiler Error Census across 26 Goal Playable Concepts

यह शोध पत्र बिना किसी पुनरावृत्ति सुधार के, एक ही बार में निष्पादन योग्य यूनिटी सी# (Unity C#) कोड उत्पन्न करने की लार्ज लैंग्वेज मॉडल्स की क्षमता का मूल्यांकन करता है, जिससे यह पता चलता है कि विभिन्न मॉडलों और स्थितियों में 10,400 जनरेशन का परीक्षण करने के बावजूद, इंजन-विशिष्ट ज्ञान की मौलिक कमी के कारण कोई भी सफलतापूर्वक संकलित (compile) नहीं हो सका, जहाँ त्रुटियों को विशिष्ट गेम अवधारणा के आधार पर या तो ग्राउंडिंग संबंधी मुद्दों (बनाई गई API) या स्वच्छता संबंधी मुद्दों (संरचनात्मक दोषों) के रूप में वर्गीकृत किया गया है।

Hugh Xuechen Liu, Kıvanç Tatar2026-07-14
💻 computer science

From Business Requirements to Test Assertions: Evaluating LLM-Generated Oracles on Real Bugs

यह शोध पत्र वास्तविक दुनिया के बग्स के लिए प्राकृतिक-भाषा व्यावसायिक आवश्यकताओं से सीधे सामान्यीकरण योग्य टेस्ट ओरेकल (test oracles) उत्पन्न करने की पांच लार्ज लैंग्वेज मॉडल्स की क्षमता का मूल्यांकन करने वाले एक पायलट अध्ययन को प्रस्तुत करता है, जिसमें यह पाया गया कि हालांकि एलएलएम (LLMs) गैर-मामूली सफलता प्राप्त करते हैं, लेकिन उनका प्रदर्शन मॉडल और बग के अनुसार काफी भिन्न होता है, और आवश्यकता के गुणों तथा ओरेकल सटीकता के बीच कोई पता लगाने योग्य रैखिक संबंध नहीं है।

Tiancheng Ma, Nasir U. Eisty2026-07-14
🤖 AI

Mitigating LLM Sycophancy in Code Smell Detection Using Evidence-Guided Reasoning Prompts

यह शोध पत्र LLM-आधारित कोड स्मेल डिटेक्शन में चापलूसी पूर्वाग्रह (sycophancy bias) का पहला व्यवस्थित अध्ययन प्रस्तुत करता है, जो यह प्रकट करता है कि मॉडल भ्रामक प्रॉम्प्ट्स के प्रति अत्यधिक संवेदनशील हैं, और एक एविडेंस-गाइडेड डिबायसिंग प्रॉम्प्टिंग (EGDP) रणनीति प्रस्तावित करता है जो साक्ष्य-प्रथम तर्क (evidence-first reasoning) को लागू करके मजबूती में महत्वपूर्ण सुधार करती है।

Istiaq Ahmed Fahad, Kamruzzaman Asif, Md. Nurul Ahad Tawhid2026-07-14