🤖 AI

Fine-Tuning Code Language Models to Detect Cross-Language Bugs

यह शोध पत्र CLCFinder और एक नए डेटासेट को प्रस्तुत करता है यह प्रदर्शित करने के लिए कि प्री-ट्रेंड कोड लैंग्वेज मॉडल्स, विशेष रूप से UniXcoder-base जैसे छोटे मॉडल्स को फाइन-ट्यून करना, क्रॉस-लैंग्वेज बग्स का पता लगाने में महत्वपूर्ण सुधार करता है, जो एक ऐसा कार्य है जहाँ सिंगल-लैंग्वेज बग डिटेक्टर्स और बड़े मॉडल्स अक्सर खराब प्रदर्शन करते हैं।

Zengyang Li, Yimeng Li, Binbin Huang, Peng Liang, Ran Mo, Hui Liu, Yutao Ma2026-04-22
🤖 AI

SpecAgent: A Speculative Retrieval and Forecasting Agent for Code Completion

SpecAgent एक नवीन एजेंट है जो इंडेक्सिंग के दौरान एसिंक्रोनस (asynchronous), स्पेक्युलेटिव कॉन्टेक्स्ट कंस्ट्रक्शन करके लार्ज लैंग्वेज मॉडल्स में कोड कंप्लीशन को बेहतर बनाता है ताकि जनरेशन की गुणवत्ता और इन्फरेंस लेटेंसी (inference latency) दोनों को एक साथ सुधारा जा सके, साथ ही यह अधिक यथार्थवादी मूल्यांकन के लिए एक लीकेज-मुक्त बेंचमार्क भी पेश करता है।

George Ma, Anurag Koul, Qi Chen, Yawen Wu, Sachit Kuhar, Yu Yu, Aritra Sengupta, Varun Kumar, Murali Krishna Ramanathan2026-04-22
💬 NLP

From Proof to Program: Characterizing Tool-Induced Reasoning Hallucinations in Large Language Models

यह शोध पत्र "टूल-इंड्यूस्ड मायोपिया" (TIM) की पहचान और लक्षण वर्णन करता है, जो एक ऐसी घटना है जहाँ टूल-ऑगमेंटेड लैंग्वेज मॉडल्स (TaLMs) गणितीय समस्याओं पर उच्च अंतिम-उत्तर सटीकता प्राप्त करते हैं लेकिन टूल आउटपुट को तर्क के विकल्प के रूप में उपयोग करने के कारण तर्कसंगत सुसंगतता में गिरावट का सामना करते हैं, और एक प्राथमिकता-अनुकूलन ढांचे का प्रस्ताव करता है ताकि मॉडल्स को टूल्स को तर्क के शॉर्टकट के बजाय सहायक साक्ष्य के रूप में उपयोग करने के लिए पुनर्गठित किया जा सके।

Farima Fatahi Bayat, Pouya Pezeshkpour, Estevam Hruschka2026-04-22
🤖 AI

Bootstrapping Code Translation with Weighted Multilanguage Exploration

यह शोध पत्र BootTrans का प्रस्ताव करता है, जो एक बूटस्ट्रैपिंग पद्धति है जो यूनिवर्सल ओरैकल के रूप में पिवट-लैंग्वेज टेस्ट सूट्स का लाभ उठाती है और डेटा की कमी तथा अनुकूलन असंतुलन को दूर करने के लिए एक लैंग्वेज-अवेयर वेटिंग मैकेनिज्म का उपयोग करती है, जिससे विविध भाषा युग्मों में मल्टीलिंगुअल कोड ट्रांसलेशन प्रदर्शन में महत्वपूर्ण सुधार होता है।

Yuhan Wu, Huan Zhang, Wei Cheng, Chen Shen, Jingyue Yang, Wei Hu2026-04-22
🤖 AI

Beyond the 'Diff': Addressing Agentic Entropy in Agentic Software Development

यह शोध पत्र एक प्रक्रिया-उन्मुख व्याख्यात्मकता ढांचे (explainability framework) को प्रस्तुत करता है जिसे "एजेंटिक एंट्रॉपी" (agentic entropy)—स्वायत्त कोडिंग एजेंटों के कार्यों और वास्तुशिल्प इरादे (architectural intent) के बीच प्रणालीगत विचलन—को कम करने के लिए डिज़ाइन किया गया है, जो ले (lay) और पेशेवर दोनों प्रकार के डेवलपर्स के लिए प्रभावी मानव निरीक्षण सुनिश्चित करने हेतु अनुरूपता सीडिंग (conformity seeding), तर्क निगरानी (reasoning monitoring) और कारण ग्राफ इंटरफेस (causal graph interfaces) के माध्यम से इरादा-स्तरीय टेलीमेट्री प्रदान करता है।

Matteo Casserini, Alessandro Facchini, Andrea Ferrario2026-04-22
💻 computer science

TypeScript Repository Indexing for Code Agent Retrieval

यह शोध पत्र abcoder-ts-parser को प्रस्तुत करता है, जो TypeScript Compiler API पर निर्मित एक TypeScript-विशिष्ट पार्सर है, जो बड़े रिपॉजिटरी के लिए काफी अधिक कुशल और विश्वसनीय ग्राफ-आधारित कोड इंडेक्सिंग को सक्षम करके पिछले LSP-आधारित इंडेक्सिंग विधियों की प्रदर्शन बाधाओं को दूर करता है।

Junsong Pu, Yichen Li, Zhuangbin Chen2026-04-22
💻 computer science

From Business Problems to AI Solutions: Where Does Transformation Support Fail

यह शोध पत्र 18 दृष्टिकोणों की समीक्षा करके व्यावसायिक समस्याओं को मशीन लर्निंग समाधानों में अनुवादित करने की मौजूदा कार्यप्रणालियों में एक महत्वपूर्ण अंतराल की पहचान करता है, जिसे "एनालिटिक्स ट्रांसलेशन प्रॉब्लम" कहा गया है, और इस रूपांतरण प्रक्रिया के लिए व्यवस्थित मार्गदर्शन स्थापित करने हेतु पांच अनुसंधान सिफारिशें प्रस्तावित करता है।

Abir Trabelsi, Imen Benzarti, Hafedh Mili, Darine Ameyed2026-04-22
💻 computer science

Security Is Relative: Training-Free Vulnerability Detection via Multi-Agent Behavioral Contract Synthesis

यह शोध पत्र फीनिक्स (Phoenix) को प्रस्तुत करता है, जो एक प्रशिक्षण-मुक्त मल्टी-एजेंट फ्रेमवर्क है जो गेरकिन (Gherkin) विनिर्देशों के माध्यम से प्रोजेक्ट-विशिष्ट व्यवहारिक अनुबंधों (behavioral contracts) को संश्लेषित करके वैश्विक भेद्यता वर्गीकरण की सीमाओं को दूर करता है, जिससे यह अत्याधुनिक पहचान सटीकता प्राप्त करता है और यह प्रदर्शित करता है कि सुरक्षा एक पूर्ण सिंटैक्स के बजाय संदर्भ द्वारा परिभाषित एक सापेक्ष गुण है।

Yongchao Wang, Zhiqiu Huang2026-04-22
🤖 AI

Refute-or-Promote: An Adversarial Stage-Gated Multi-Agent Review Methodology for High-Precision LLM-Assisted Defect Discovery

यह शोध पत्र "Refute-or-Promote" को प्रस्तुत करता है, जो एक प्रतिकूल मल्टी-एजेंट फ्रेमवर्क है जो LLM-सहायता प्राप्त दोष खोज (defect discovery) में फॉल्स पॉजिटिव्स को फ़िल्टर करने के लिए स्ट्रैटिफाइड कॉन्टेक्स्ट हंटिंग, क्रॉस-मॉडल क्रिटीक और अनिवार्य एम्पिरिकल वैलिडेशन का उपयोग करता है, जिससे उच्च परिशुद्धता और वास्तविक दुनिया का प्रभाव प्राप्त होता है जिसमें सुरक्षा लाइब्रेरी और कंपाइलर में कई CVEs और मानक स्वीकृतियां शामिल हैं।

Abhinav Agarwal2026-04-22
💻 computer science

Cascaded Code Editing: Large-Small Model Collaboration for Effective and Efficient Code Editing

यह शोध पत्र एक कैस्केड कोड एडिटिंग फ्रेमवर्क का प्रस्ताव करता है जो संक्षिप्त एडिट स्केच उत्पन्न करने के लिए एक बड़े मॉडल और उन्हें लागू करने के लिए एक छोटे, अधिक कुशल मॉडल का लाभ उठाता है, जिससे लंबे संदर्भों और क्रॉस-फाइल निर्भरताओं को संभालने में छोटे मॉडलों की सीमाओं को संबोधित करते हुए प्रभावशीलता और दक्षता के बीच संतुलन बनाया जा सके।

Chaozheng Wang, Zezhou Yang, Shuzheng Gao, Cuiyun Gao, Zongjie Li, Yichen Li, Ting Peng, Hailiang Huang, Yuetang Deng, M (…)2026-04-22