💻 computer science

GLiSE: A Prompt-Driven and ML-Powered Tool for Automated Grey Literature Extraction in Software Engineering

यह शोध पत्र GLiSE प्रस्तुत करता है, जो एक पुनरुत्पादनीय (reproducible), प्रॉम्प्ट-संचालित टूल है जो मशीन लर्निंग का उपयोग करके विविध सॉफ्टवेयर इंजीनियरिंग स्रोतों से ग्रे लिटरेचर के निष्कर्षण, फ़िल्टरिंग और रैंकिंग को स्वचालित करता है, जिसके साथ एक क्यूरेटेड डेटासेट और एक अनुभवजन्य उपयोगिता अध्ययन भी संलग्न है।

Houcine Abdelkader Cherief, Brahim Mahmoudi, Zacharie Chenail-Larcher, Naouel Moha, Quentin Sti'evenart, Florent Avellan (…)2026-02-04
💻 computer science

Automated Generation of Accurate Privacy Captions From Android Source Code Using Large Language Models

यह शोध पत्र PCapGen को प्रस्तुत करता है, जो एक स्वचालित ढांचा है जो सटीक सोर्स कोड संदर्भ निकालने और एंड्रॉइड ऐप्स के लिए सटीक, संक्षिप्त और पूर्ण गोपनीयता विवरण (privacy captions) उत्पन्न करने के लिए लार्ज लैंग्वेज मॉडल्स का लाभ उठाता है, जो विशेषज्ञ और स्वचालित दोनों मूल्यांकनों में मौजूदा विधियों से बेहतर प्रदर्शन करता है।

Vijayanta Jain, Sepideh Ghanavati, Sai Teja Peddinti, Collin McMillan2026-02-04
💬 NLP

Closing the Loop: Universal Repository Representation with RPG-Encoder

यह शोध पत्र RPG-Encoder को प्रस्तुत करता है, जो एक ऐसा ढांचा है जो रॉ कोड को एक गतिशील रिपॉजिटरी प्लानिंग ग्राफ (Repository Planning Graph) में एनकोड करके रिपॉजिटरी बोध (repository comprehension) और जनरेशन को एक उच्च-सटीक, स्केलेबल प्रतिनिधित्व में एकीकृत करता है, जिससे कोड लोकलाइजेशन में अत्याधुनिक प्रदर्शन और लगभग पूर्ण पुनर्निर्माण कवरेज प्राप्त होता है।

Jane Luo, Chengyu Yin, Xin Zhang, Qingtao Li, Steven Liu, Yiming Huang, Jie Wu, Hao Liu, Yangyu Huang, Yu Kang, Fangkai (…)2026-02-04
🤖 AI

BatCoder: Self-Supervised Bidirectional Code-Documentation Learning via Back-Translation

BatCoder एक सेल्फ-सुपरवाइज्ड रीइन्फोर्समेंट लर्निंग फ्रेमवर्क है जो केवल अनलेबल कोड का उपयोग करके कोड जनरेशन और डॉक्यूमेंटेशन प्रोडक्शन को संयुक्त रूप से अनुकूलित करने के लिए बैक-ट्रांसलेशन रणनीति का लाभ उठाता है, जो मानक बेंचमार्क पर स्टेट-ऑफ-द-आर्ट प्रदर्शन प्राप्त करता है और मॉडल के आकार एवं कॉर्पस वॉल्यूम के साथ प्रभावी ढंग से स्केल करता है।

Jingwen Xu, Yiyang Lu, Zisu Huang, Changze Lv, Xiaohua Wang, Shizheng Li, Zhibo Xu, Zhengkang Guo, Zhengyuan Wang, Muzha (…)2026-02-04
💬 NLP

Uncertainty and Fairness Awareness in LLM-Based Recommendation Systems

यह शोध पत्र एलएलएम-आधारित अनुशंसा प्रणालियों (LLM-based recommendation systems) के लिए एक व्यापक बेंचमार्क और मूल्यांकन पद्धति प्रस्तुत करता है जो भविष्यवाणात्मक अनिश्चितता को परिमाणित करता है और व्यवस्थित जनसांख्यिकीय एवं व्यक्तित्व-जुड़े पूर्वाग्रहों को प्रकट करता है, जिससे सुरक्षित, अधिक न्यायसंगत और व्याख्या योग्य अनुशंसा मॉडल विकसित करने के लिए एक आधार स्थापित होता है।

Chandan Kumar Sah, Xiaoli Lian, Li Zhang, Tony Xu, Syed Shazaib Shah2026-02-04
🤖 AI

Constitutional Spec-Driven Development: Enforcing Security by Construction in AI-Assisted Code Generation

यह शोध पत्र कॉन्स्टिट्यूशनल स्पेक-ड्रिवन डेवलपमेंट (Constitutional Spec-Driven Development) को प्रस्तुत करता है, जो एक ऐसी कार्यप्रणाली है जो AI-सहायता प्राप्त कोड जनरेशन में 'सिक्योरिटी बाय कंस्ट्रक्शन' को लागू करने के लिए स्पेसिफिकेशन लेयर में मशीन-पठनीय सुरक्षा बाधाओं को समाहित करती है, जो डेवलपर वेलोसिटी बनाए रखते हुए सुरक्षा संबंधी दोषों में 73% की कमी प्रदर्शित करती है।

Srinivas Rao Marri2026-02-04
🤖 AI

Agentic Observability: Automated Alert Triage for Adobe E-Commerce

यह शोध पत्र एडोब के ई-कॉमर्स इंफ्रास्ट्रक्चर में तैनात एक एजेंटिक ऑब्जर्वेबिलिटी फ्रेमवर्क प्रस्तुत करता है जो डायनामिक लॉग विश्लेषण और कॉन्टेक्स्ट-अवेयर एक्शन प्लानिंग के माध्यम से नैदानिक सटीकता बनाए रखते हुए, री-एक्ट (ReAct) प्रतिमान का उपयोग करके स्वायत्त रूप से अलर्ट ट्राइएज करता है, जिससे मीन टाइम टू इनसाइट में 90% की कमी आती है।

Aprameya Bharadwaj, Kyle Tu2026-02-04
💻 computer science

AROLA: A Modular Layered Architecture for Scaled Autonomous Racing

यह शोध पत्र AROLA को प्रस्तुत करता है, जो स्केल्ड ऑटोनॉमस रेसिंग के लिए एक मॉड्यूलर, लेयर्ड सॉफ्टवेयर आर्किटेक्चर है, जो तीव्र मॉड्यूल प्रतिस्थापन और निष्पक्ष बेंचमार्किंग को सक्षम करने के लिए मानकीकृत ROS 2 इंटरफेस का उपयोग करता है, जिसे निरंतर वास्तविक समय प्रदर्शन मूल्यांकन के लिए एक रेस मॉनिटर फ्रेमवर्क द्वारा पूरक किया गया है और सिमुलेशन एवं 2025 रोबोरेसर प्रतियोगिता के माध्यम से मान्य किया गया है।

Fam Shihata, Mohammed Abdelazim, Ahmed Hussein2026-02-04
💻 computer science

Beyond the Prompt: Assessing Domain Knowledge Strategies for High-Dimensional LLM Optimization in Software Engineering

यह शोध पत्र इस बात की जांच करता है कि कैसे चार विशिष्ट आर्किटेक्चर के माध्यम से डोमेन ज्ञान को एकीकृत करना—जिसमें 'ह्यूमन-इन-द-लूप प्रॉम्प्टिंग' से लेकर हाइब्रिड सांख्यिकीय-RAG दृष्टिकोण तक शामिल हैं—लार्ज लैंग्वेज मॉडल्स को उन उच्च-आयामी सॉफ्टवेयर इंजीनियरिंग अनुकूलन कार्यों के लिए प्रभावी ढंग से 'वॉर्म स्टार्ट' उत्पन्न करने में सक्षम बना सकता है जहाँ वे वर्तमान में बेयसियन विधियों की तुलना में कम प्रदर्शन करते हैं।

Srinath Srinivasan, Tim Menzies2026-02-04
💻 computer science

Failure-Aware Enhancements for Large Language Model (LLM) Code Generation: An Empirical Study on Decision Framework

25 GitHub प्रोजेक्ट्स के एक अनुभवजन्य अध्ययन के माध्यम से, यह शोध पत्र प्रकट करता है कि LLM कोड जनरेशन संवर्धन रणनीतियों की प्रभावशीलता विफलता के प्रकार के आधार पर काफी भिन्न होती है, जिससे एक प्रस्तावित निर्णय ढांचा सामने आता है जो चिकित्सकों को कार्य पूर्णता को अधिकतम करने के लिए विशिष्ट विफलता विशेषताओं के आधार पर इष्टतम विधि—जैसे कि RAG या सेल्फ-क्रिटिक—चुनने में मार्गदर्शन करता है।

Jianru Shen, Zedong Peng, Lucy Owen2026-02-04