🤖 AI

Lean4Agent: Formal Modeling and Verification for Agent Workflow and Trajectory

यह शोध पत्र **Lean4Agent** को प्रस्तुत करता है, जो पहला ऐसा फ्रेमवर्क है जो एजेंट वर्कफ़्लो को मॉडल, सत्यापित और पुनरावृत्ति रूप से परिष्कृत करने के लिए डिपेंडेंट-टाइप औपचारिक भाषा Lean4 का लाभ उठाता है, यह प्रदर्शित करते हुए कि औपचारिक रूप से सत्यापित प्रक्षेपवक्र (trajectories) जटिल कार्यों पर लार्ज लैंग्वेज मॉडल्स के प्रदर्शन और विश्वसनीयता में महत्वपूर्ण सुधार करते हैं।

Ruida Wang, Jerry Huang, Pengcheng Wang, Xuanqing Liu, Luyang Kong, Tong Zhang2026-06-08
💻 computer science

Queen-Bee Agents: A BeeSpec-Centered Architecture for Governed Enterprise MCP Orchestration

यह शोध पत्र क्वीन-बी (Queen-Bee) को प्रस्तुत करता है, जो एक नियंत्रित मल्टी-एजेंट आर्किटेक्चर है जो विशिष्ट एजेंटों के लिए संरचित बी-स्पेक्स (BeeSpecs) उत्पन्न करने के लिए एक केंद्रीय नियंत्रण प्लेन का उपयोग करता है, जो मॉडल कॉन्टेक्स्ट प्रोटोकॉल (MCP) एकीकरण के माध्यम से नीति अनुपालन, टेनेंट आइसोलेशन और स्कैप्ड निष्पादन को लागू करके एंटरप्राइज वातावरण में उच्च कार्य सफलता दर और शून्य गवर्नेंस विफलताएं प्राप्त करता है।

Dutao Zhang, Liaotian2026-06-08
💻 computer science

NTILC: Neural Tool Invocation via Learned Compression

NTILC एक न्यूरल फ्रेमवर्क है जो लीनियर इन-कॉन्टेक्स्ट टूल रजिस्ट्री लुकअप को सीखे गए लेटेंट रिट्रीवल और एक सिग्नेचर-अवेयर कंपोजिट ऑब्जेक्टिव से बदल देता है, जिससे एजेंटिक टूल-कॉलिंग मॉडल्स के लिए उच्च चयन सटीकता बनाए रखते हुए 95% से अधिक कॉन्टेक्स्ट टोकन रिडक्शन और 74% तक कम लेटेंसी प्राप्त होती है।

Andrew Krikorian, Yayuan Li, Jason J. Corso2026-06-08
💻 computer science

AutoPipelineAI: Context-Aware CI/CD Pipeline Generation from Natural Language

यह शोध पत्र AutoPipelineAI को प्रस्तुत करता है, जो प्राकृतिक भाषा के विवरणों से सटीक और सत्यापित CI/CD पाइपलाइन कॉन्फ़िगरेशन को स्वचालित रूप से उत्पन्न करने के लिए लार्ज लैंग्वेज मॉडल्स का लाभ उठाता है, जिससे डेवलपर्स के लिए DevOps सेटअप सरल हो जाता है और कॉन्फ़िगरेशन त्रुटियां कम हो जाती हैं।

Youssef Mohamed Aboelfotoh, Mohamed Ahmed Hemdan, Mohammad El-Ramly, Khlood Hassan, Mahmoud Saleh Saad, Ahmed Mohamed To (…)2026-06-08
💻 computer science

Pomona: Continuous Code Quality Improvement via Small, Automated Changes at Bloomberg

यह शोध पत्र पोमोना (Pomona) को प्रस्तुत करता है, जो काइज़न (Kaizen) से प्रेरित एक हल्का एजेंटिक टूल है, जो ब्लूमबर्ग में छोटे, कम जोखिम वाले पुल रिक्वेस्ट के माध्यम से तकनीकी ऋण (technical debt) की खोज और क्रमिक सुधार को स्वचालित करके कोड की गुणवत्ता में निरंतर सुधार करता है, जिससे एक महीने के परिनियोजन में उच्च मर्ज सफलता दर और मजबूत इंजीनियर स्वीकृति प्राप्त हुई।

David Williams, Angelos Evripiotis, Serkan Kirbas, Harry Morgan, Sergey Magidovich, Peter Wainwright, Federica Sarro2026-06-08
💻 computer science

The Custody Envelope Threshold: Authority-Scaled Admission of External Artifacts in Institutional Infrastructure

यह शोध पत्र "कस्टडी एनवेलप थ्रेशोल्ड" (Custody Envelope Threshold) का प्रस्ताव करता है, जो बाहरी बुनियादी ढांचे के आर्टिफैक्ट्स को स्वीकार करने के लिए एक अधिकार-आधारित ढांचा है, जो यह तर्क देता है कि संस्थानों को बाहरी वस्तुओं को केवल तभी सीधे स्वीकार करना चाहिए जब उनकी पहचान, प्रवेश और प्रतिसंहरण क्षमताएं उनके प्रत्यायोजित निष्पादन अधिकार के सापेक्ष पर्याप्त रूप से बंद हों, अन्यथा जोखिम को कम करने के लिए मध्यस्थता या अस्वीकृति का सहारा लेना चाहिए।

Amadeus Brandes2026-06-08
💻 computer science

From Custom Logic to APIs: Understanding and Recommending API Replacement Refactorings

यह शोध पत्र AKIRA प्रस्तुत करता है, जो एक हाइब्रिड फ्रेमवर्क है जो पैटर्न-डिटरमिनिस्टिक ह्यूरिस्टिक्स को रिफैक्टरिंग-अवेयर नॉलेज बेस के साथ जोड़ता है ताकि प्रभावी ढंग से API रिप्लेसमेंट रिफैक्टरिंग की पहचान और अनुशंसा की जा सके, जिससे मौजूदा अत्याधुनिक टूल्स की तुलना में काफी अधिक प्रिसिजन और रिकॉल प्राप्त होता है।

Bridget Nyirongo, Yanjie Jiang, Yuxia Zhang, Hui Liu2026-06-08
🤖 AI

Declarative Skills for AI Agents in Knowledge-Grounded Tool-Use Workflows

यह शोध पत्र तर्क देता है कि डिक्लेरेटिव एजेंट (declarative agents), जो ऑर्केस्ट्रेशन के लिए प्राकृतिक-भाषा कौशल फ़ाइलों का उपयोग करते हैं, अधूरे साक्ष्य की प्रमुख बाधा को दूर करने के लिए उच्च-गुणवत्ता वाली रिट्रीवल (retrieval) की उपलब्धता होने पर, ज्ञान-आधारित टूल-उपयोग वर्कफ़्लो में कठोर इम्पैरेटिव स्टेट मशीनों (imperative state machines) की तुलना में सटीकता में सुधार करके और त्रुटियों को कम करके बेहतर प्रदर्शन करते हैं।

M. Danish Lim, I. Danial Bin Sharudin, Wen Han Chen, Cedric Lim, Laura Wynter2026-06-08
💻 computer science

Porting Declarative UI to HarmonyOS: A Heuristic-guided LLM Approach

यह शोध पत्र ArkTrans को प्रस्तुत करता है, जो एक ह्यूरिस्टिक-गाइडेड (heuristic-guided) LLM दृष्टिकोण है जो भाषा-विशिष्ट स्केलेटन (skeletons) का निर्माण करके और पोस्ट-फिक्सिंग नियमों (post-fixing rules) को लागू करके Android और iOS के डिक्लेरेटिव UI कोड को HarmonyOS के ArkUI में स्वचालित रूप से अनुवादित करता है, जिससे डायरेक्ट प्रॉम्प्टिंग (direct prompting) विधियों की तुलना में उच्च दृश्य निष्ठा (visual fidelity) के साथ 90.67% तक सफल संकलन (compilation) प्राप्त होता है।

Kunwu Zheng, Pengyu Xue, Zhen Yang, Xiran Lyu, Peishi Lai, Mengying Zhao, Yutian Tang, Huizhi Zhang, Xianhang Li, Linhao (…)2026-06-08
💻 computer science

MalSkillBench: A Runtime-Verified Benchmark of Malicious Agent Skills

यह शोध पत्र MalSkillBench को प्रस्तुत करता है, जो 3,944 दुर्भावनापूर्ण AI एजेंट कौशलों से युक्त पहला रनटाइम-सत्यापित बेंचमार्क है, यह प्रदर्शित करने के लिए कि वर्तमान डिटेक्शन टूल्स कोड और निर्देशों का संयुक्त रूप से विश्लेषण करने में विफल रहते हैं, जिससे एजेंट सप्लाई चेन को सुरक्षित करने के लिए टास्क इंटेंट (कार्य हेतु इरादा), कोड और प्रॉम्प्ट्स के बीच तर्क करने वाले एक नए दृष्टिकोण की आवश्यकता उत्पन्न होती है।

Wenbo Guo, Wei Zeng, Chengwei Liu, Xiaojun Jia, Yijia Xu, Lei Tang, Yong Fang, Yang Liu2026-06-08