🤖 AI

DoVer: Intervention-Driven Auto Debugging for LLM Multi-Agent Systems

DoVer एक इंटरवेंशन-संचालित ऑटो-डीबगिंग फ्रेमवर्क है जो LLM मल्टी-एजेंट सिस्टम के लिए है, जो लक्षित हस्तक्षेपों के माध्यम से परिकल्पनाओं को सक्रिय रूप से सत्यापित करके और एट्रिब्यूशन सटीकता के बजाय कार्य रिकवरी और प्रगति के माध्यम से सफलता को मापकर लॉग-ओनली फेलियर लोकलाइजेशन की सीमाओं को दूर करता है।

Ming Ma, Jue Zhang, Fangkai Yang, Yu Kang, Qingwei Lin, Saravan Rajmohan, Dongmei Zhang2026-02-03
🤖 machine learning

Harmonica: A Self-Adaptation Exemplar for Sustainable MLOps

यह शोध पत्र Harmonica को प्रस्तुत करता है, जो HarmonE दृष्टिकोण पर आधारित एक स्व-अनुकूलन उदाहरण (self-adaptation exemplar) है, जो स्थिरता मेट्रिक्स की निगरानी करने और आर्किटेक्चरल टैक्टिक्स को स्वचालित रूप से ट्रिगर करने के लिए MAPE-K लूप का उपयोग करता है, जिससे MLOps पाइपलाइनों के भीतर मशीन लर्निंग-सक्षम प्रणालियों के टिकाऊ और स्थिर संचालन को सक्षम बनाया जा सके।

Ananya Halgatti, Shaunak Biswas, Hiya Bhatt, Srinivasan Rakhunathan, Karthik Vaidhyanathan2026-02-03
🤖 AI

HELIOS: Hierarchical Graph Abstraction for Structure-Aware LLM Decompilation

यह शोध पत्र HELIOS प्रस्तुत करता है, जो एक ऐसा ढांचा है जो कंट्रोल फ्लो और फंक्शन कॉल्स को एक पदानुक्रमित ग्राफ एब्स्ट्रैक्शन (hierarchical graph abstraction) में परिवर्तित करके LLM-आधारित बाइनरी डीकंपाइलेशन को बढ़ाता है, जिससे मॉडल फाइन-ट्यूनिंग की आवश्यकता के बिना विविध आर्किटेक्चर पर कोड की कंपाइलेबिलिटी और कार्यात्मक शुद्धता में महत्वपूर्ण सुधार होता है।

Yonatan Gizachew Achamyeleh, Harsh Thomare, Mohammad Abdullah Al Faruque2026-02-03
💬 NLP

KAPSO: A Knowledge-grounded framework for Autonomous Program Synthesis and Optimization

KAPSO एक मॉड्यूलर, ज्ञान-आधारित ढांचा है जो एक गिट-नेटिव (git-native) प्रयोग इंजन, एक संरचित ज्ञान प्रणाली और एक संज्ञानात्मक स्मृति परत को एकीकृत करके स्वायत्त प्रोग्राम संश्लेषण और अनुकूलन को बढ़ाता है, ताकि कोड आर्टिफैक्ट्स में सुधार किया जा सके और कोडिंग एजेंटों में होने वाली दीर्घकालिक विफलताओं को दूर किया जा सके।

Alireza Nadafian, Alireza Mohammadshahi, Majid Yazdani2026-02-03
🤖 AI

Bridging Forecast Accuracy and Inventory KPIs: A Simulation-Based Software Framework

यह शोध पत्र एक निर्णय-केंद्रित सिमुलेशन ढांचे (डिसीजन-सेंट्रिक सिमुलेशन फ्रेमवर्क) को प्रस्तुत करता है जो ऑटोमोटिव आफ्टरमार्केट में सांख्यिकीय पूर्वानुमान सटीकता और परिचालन इन्वेंटरी के प्रमुख प्रदर्शन संकेतकों (केपीआई) के बीच के अंतर को पाटता है, यह प्रदर्शित करते हुए कि पारंपरिक त्रुटि मेट्रिक्स में सुधार आवश्यक रूप से बेहतर लागत और सेवा परिणामों में परिवर्तित नहीं होता है और वास्तविक व्यावसायिक प्रभाव के आधार पर मॉडलों का मूल्यांकन करने के लिए एक उपकरण प्रदान करता है।

So Fukuhara, Abdallah Alabdallah, Nuwan Gunasekara, Slawomir Nowaczyk2026-02-03
🤖 AI

Why Are AI Agent Involved Pull Requests (Fix-Related) Remain Unmerged? An Empirical Study

यह अनुभवजन्य अध्ययन पांच एआई कोडिंग एजेंटों के 8,000 से अधिक फिक्स-संबंधित पुल रिक्वेस्ट का विश्लेषण करता है ताकि यह पहचान की जा सके कि टेस्ट केस विफलताओं और डुप्लिकेट इश्यू समाधानों के कारण मर्ज करने में मुख्य बाधाएं आती हैं, जबकि बिल्ड विफलताएं दुर्लभ हैं, जिससे वर्तमान एआई एजेंटों की प्रमुख सीमाओं और सॉफ्टवेयर रखरखाव में मानव-एआई सहयोग को सुधारने की दिशाओं पर प्रकाश पड़ता है।

Khairul Alam, Saikat Mondal, Banani Roy2026-02-03
🤖 AI

Spec-Driven Development:From Code to Contract in the Age of AI Coding Assistants

यह शोध पत्र स्पेसिफिकेशन-ड्रिवन डेवलपमेंट (SDD) के लिए एक व्यापक मार्गदर्शिका प्रस्तुत करता है, जो इसके सिद्धांतों, स्पेसिफिकेशन की तीन स्तरों की कठोरता और सहायक उपकरणों को रेखांकित करता है ताकि यह प्रदर्शित किया जा सके कि कैसे स्पेसिफिकेशन को प्राथमिक आर्टिफैक्ट (artifact) के रूप में मानने से विविध सॉफ्टवेयर डोमेन में एआई कोडिंग असिस्टेंट का प्रभावी ढंग से लाभ उठाया जा सकता है।

Deepak Babu Piskala2026-02-03
💻 computer science

RVDebloater: Mode-based Adaptive Firmware Debloating for Robotic Vehicles

यह शोध पत्र RVDebloater प्रस्तुत करता है, जो एक नवीन अनुकूलनशील तकनीक है जो रोबोटिक वाहनों के परिचालन मोड के आधार पर फंक्शन स्तर पर अनावश्यक फर्मवेयर कोड को गतिशील रूप से हटा देती है, जिससे मिशन-महत्वपूर्ण कार्यक्षमता को न्यूनतम प्रदर्शन और मेमोरी ओवरहेड के साथ बनाए रखते हुए, हमले की सतह (attack surface) और संसाधन उपयोग को महत्वपूर्ण रूप से कम किया जाता है।

Mohsen Salehi, Karthik Pattabiraman2026-02-03
💻 computer science

Towards Analyzing N-language Polyglot Programs

यह शोध पत्र तीन या अधिक भाषाओं वाले पॉलीग्लॉट सिस्टम के विश्लेषण के संबंध में वर्तमान अनुसंधान के अंतराल को संबोधित करता है, जिसमें प्रमुख चुनौतियों की पहचान की गई है और स्केलेबल, भाषा-अज्ञेय (लैंग्वेज-अगनोस्टिक) स्टैटिक एनालिसिस फ्रेमवर्क विकसित करने के लिए एक वैचारिक रोडमैप प्रस्तावित किया गया है।

Jyoti Prakash, Abhishek Tiwari, Mikkel Baun Kjærgaard2026-02-03
💻 computer science

Are Coding Agents Generating Over-Mocked Tests? An Empirical Study

1.2 मिलियन से अधिक कमिट्स (commits) के इस अनुभवजन्य अध्ययन से पता चलता है कि कोडिंग एजेंट, गैर-एजेंटों की तुलना में टेस्ट जेनरेट करने और विशेष रूप से उन्हें अत्यधिक मॉक (over-mock) करने की काफी अधिक संभावना रखते हैं, जो टेस्ट की रखरखाव क्षमता (maintainability) और प्रभावशीलता के बारे में चिंताएँ पैदा करता है और बेहतर एजेंट कॉन्फ़िगरेशन मार्गदर्शन की आवश्यकता को रेखांकित करता है।

Andre Hora, Romain Robbes2026-02-03