💻 computer science

Think Before You Act -- A Neurocognitive Governance Model for Autonomous AI Agents

यह शोध पत्र एक न्यूरोकॉग्निटिव गवर्नेंस फ्रेमवर्क प्रस्तावित करता है जो एक 'प्री-एक्शन गवर्नेंस रीजनिंग लूप' के माध्यम से स्वायत्त एआई एजेंटों में मानव-समान "कार्य करने से पहले सोचें" वाली विचार-विमर्श प्रक्रिया को समाहित करता है, जिससे वे चार-स्तरीय नियम पदानुक्रम के विरुद्ध कार्यों का आंतरिक मूल्यांकन करने और बाहरी बाधाओं पर निर्भर रहे बिना उच्च अनुपालन प्राप्त करने में सक्षम होते हैं।

Eranga Bandara, Ross Gore, Asanga Gunaratna, Sachini Rajapakse, Isurunima Kularathna, Ravi Mukkamala, Sachin Shetty, Xue (…)2026-04-29
💻 computer science

Spreadsheet Modeling Experiments Using GPTs on Small Problem Statements and the Wall Task

यह शोध पत्र पुन: प्रयोज्य स्प्रेडशीट मॉडल बनाने में GPT-आधारित उपकरणों, विशेष रूप से एक्सेल एआई (Excel AI) की क्षमताओं का मूल्यांकन करता है, जिसमें यह पाया गया है कि हालांकि वे सुव्यवस्थित ड्राफ्ट तैयार कर सकते हैं, लेकिन उनकी असंगतता, पुनरुत्पादकता का अभाव और परिणामस्वरूप कुशल उपयोगकर्ता सत्यापन की आवश्यकता वर्तमान में पेशेवर उपयोग के लिए उनकी विश्वसनीयता को सीमित करती है।

Thomas A. Grossman, Yuan Chen, Sopiko Datuashvili2026-04-29
💬 NLP

Cross-Lingual Jailbreak Detection via Semantic Codebooks

यह शोध पत्र एक प्रशिक्षण-मुक्त, भाषा-निरपेक्ष जेलब्रेक डिटेक्शन विधि प्रस्तावित करता है जो बहुभाषी क्वेरी एम्बेडिंग्स की तुलना दुर्भावनापूर्ण प्रॉम्प्ट्स के एक निश्चित अंग्रेजी कोडबुक से करता है, और यह प्रदर्शित करता है कि जबकि सिमेंटिक समानता विभिन्न भाषाओं में कैनोनिकल टेम्पलेट्स पर हमलों को प्रभावी ढंग से कम करती है, विविध और विषम असुरक्षित व्यवहारों से जुड़े वितरण बदलावों (डिस्ट्रीब्यूशन शिफ्ट्स) के तहत इसका प्रदर्शन काफी घट जाता है।

Shirin Alanova, Bogdan Minko, Sabrina Sadiekh, Evgeniy Kokuykin2026-04-29
💻 computer science

Scalable Inference Architectures for Compound AI Systems: A Production Deployment Study

यह शोध पत्र सेल्सफोर्स में एक मॉड्यूलर, प्लेटफॉर्म-अज्ञेय (प्लेटफॉर्म-एग्नोस्टिक) इन्फरेंस आर्किटेक्चर के प्रोडक्शन डिप्लॉयमेंट अध्ययन को प्रस्तुत करता है जो एजेंटफोर्स (Agentforce) और एपेक्सगुरु (ApexGuru) जैसे कंपाउंड एआई सिस्टम की स्केलेबल, लागत प्रभावी और कम-विलंबता वाली सर्विसिंग को सक्षम बनाता है, जिससे मल्टी-मॉडल फैन-आउट और कैस्केडिंग कोल्ड स्टार्ट जैसी अनूठी चुनौतियों का समाधान करते हुए थ्रूपुट, टेल लेटेंसी और परिचालन लागत में महत्वपूर्ण सुधार प्राप्त हुआ है।

Srikanta Prasad S V, Utkarsh Arora2026-04-29
💻 computer science

Toward Scalable Terminal Task Synthesis via Skill Graphs

यह शोध पत्र SkillSynth को प्रस्तुत करता है, जो एक परिदृश्य-मध्यस्थता कौशल ग्राफ (scenario-mediated skill graph) का लाभ उठाकर विविध और नियंत्रणीय टर्मिनल कार्य इंस्टेंस को संश्लेषित करने के लिए एक स्वचालित ढांचा है, जिससे डेटा की कमी को दूर किया जा सके और स्वायत्त टर्मिनल एजेंटों के प्रशिक्षण को बढ़ाया जा सके।

Zhiyuan Fan, Tinghao Yu, Yuanjun Cai, Jiangtao Guan, Yun Yang, Dingxin Hu, Jiang Zhou, Xing Wu, Zhuo Han, Feng Zhang, Li (…)2026-04-29
💻 computer science

Verification of Neural Networks (Lecture Notes)

यह शोधपत्र व्याख्यान नोट्स प्रस्तुत करता है जो न्यूरल नेटवर्क सत्यापन का एक सैद्धांतिक परिचय प्रदान करते हैं, जिसमें फीड-फॉरवर्ड नेटवर्क, आरएनएन (RNNs) और ट्रांसफॉर्मर जैसे आर्किटेक्चर के साथ-साथ विनिर्देश भाषाओं (specification languages) और एल्गोरिद्मिक तकनीकों को शामिल किया गया है।

Benedikt Bollig2026-04-29
💻 computer science

SAFEdit: Does Multi-Agent Decomposition Resolve the Reliability Challenges of Instructed Code Editing?

यह शोध पत्र SAFEdit प्रस्तुत करता है, जो एक मल्टी-एजेंट फ्रेमवर्क है जो निर्देशित कोड संपादन को प्लानिंग, लिटरल मॉडिफिकेशन और वेरिफिकेशन भूमिकाओं में विभाजित करता है जिसे एक फेलियर एब्स्ट्रैक्शन लेयर द्वारा उन्नत किया गया है, जिससे EditBench बेंचमार्क पर 68.6% टास्क सक्सेस रेट प्राप्त होता है और यह सिंगल-मॉडल और ReAct सिंगल-एजेंट बेसलाइन्स दोनों से काफी बेहतर प्रदर्शन करता है।

Noam Tarshish, Nofar Selouk, Daniel Hodisan, Bar Ezra Gafniel, Yuval Elovici, Asaf Shabtai, Eliya Nachmani2026-04-29
💻 computer science

Can Code Evaluation Metrics Detect Code Plagiarism?

यह शोध पत्र अनुभवजन्य रूप से प्रदर्शित करता है कि कोड मूल्यांकन मेट्रिक्स, विशेष रूप से क्रिस्टलब्लू (CrystalBLEU), विभिन्न संशोधन स्तरों में सोर्स कोड प्लेजरिज्म (साहित्यिक चोरी) का प्रभावी ढंग से पता लगा सकते हैं और अक्सर प्रीप्रोसेसिंग लागू होने पर डोलोस (Dolos) और जेप्लैग (JPlag) जैसे समर्पित प्लेजरिज्म डिटेक्शन टूल्स से बेहतर या उनके बराबर प्रदर्शन करते हैं।

Fahad Ebrahim (The University of Warwick), Mike Joy (The University of Warwick)2026-04-29
🤖 machine learning

Sustained Gradient Alignment Mediates Subliminal Learning in a Multi-Step Setting: Evidence from MNIST Auxiliary Logit Distillation Experiment

यह शोध पत्र यह प्रदर्शित करता है कि निरंतर, दुर्बल रूप से सकारात्मक ग्रेडिएंट संरेखण (gradient alignment), मल्टी-स्टेप MNIST ऑक्जिलरी लॉजिट डिस्टिलेशन में अवचेतन अधिगम (subliminal learning) को मध्यस्थता प्रदान करता है, जो यह प्रकट करता है कि लिमिनल ट्रेनिंग (liminal training) जैसी शमन रणनीतियाँ अनपेक्षित लक्षण प्राप्ति को दबाने में विफल हो सकती हैं जब प्रथम-क्रम के ग्रेडिएंट चालक (first-order gradient drives) प्रभावी होते हैं।

Chayanon Kitkana, Shivam Arora2026-04-29
💻 computer science

At the Edge of the Heart: ULP FPGA-Based CNN for On-Device Cardiac Feature Extraction in Smart Health Sensors for Astronauts

यह शोध पत्र एक अल्ट्रा-लो-पावर FPGA-आधारित समाधान प्रस्तुत करता है जो एक क्वांटाइज्ड CNN का उपयोग करके रियल-टाइम सीस्मोंकार्डियोग्राफी फीचर क्लासिफिकेशन में 98% सटीकता प्राप्त करता है, जो संसाधन-सीमित अंतरिक्ष मिशनों पर अंतरिक्ष यात्रियों के लिए ऊर्जा-कुशल, स्वायत्त हृदय निगरानी को सक्षम बनाता है।

Kazi Mohammad Abidur Rahman, Davis Rakhshan, Philipp Lütke, Laura Harms, Ulf Kulau2026-04-29