💻 computer science

Why Trust Your Agent? Empirical Security Gains from TRiSM-Guided Agentic Workflows in Healthcare

यह शोध पत्र प्रदर्शित करता है कि मेडिकल रिपोर्ट-जनरेशन एजेंटों पर TRiSM फ्रेमवर्क लागू करने से सुरक्षा—जो कई LLMs और वेक्टर्स में हमले की सफलता दर को कम करती है—और लीस्ट-प्रिविलेज (least-privilege) एवं डिफेंस-इन-डेप्थ (defense-in-depth) आर्किटेक्चरल डिज़ाइनों के माध्यम से आउटपुट सटीकता में 14 प्रतिशत अंकों की वृद्धि, दोनों में महत्वपूर्ण सुधार होता है।

Liam Kearns2026-06-30
💻 computer science

Capability Gates Are Not Authorization: Confused-Deputy Failures in LLM Agent Frameworks

यह शोध पत्र यह प्रकट करता है कि लैंगचेन (LangChain) और लामाइंडेक्स (LlamaIndex) जैसे लोकप्रिय एलएलएम (LLM) एजेंट फ्रेमवर्क निष्पादन से पहले विशिष्ट तर्क मानों (argument values) को पुन: सत्यापित करने में विफल रहकर, टूल एक्सपोज़र (tool exposure) को प्राधिकरण (authorization) के साथ मिला देते हैं, और "स्कोपगेट" (ScopeGate) का प्रस्ताव करता है, जो एक पांच-चरणीय प्राधिकरण ढांचा है जो वैध अनुरोधों के लिए उच्च सटीकता बनाए रखते हुए अवैध भुगतानों जैसे अनधिकृत कार्यों को सफलतापूर्वक रोकता है।

David Mellafe Zuvic2026-06-30
💻 computer science

Formal Security Analysis of Agent Protocol Composition

यह शोधपत्र AgentThread प्रस्तुत करता है, जो एक औपचारिक सुरक्षा विश्लेषण ढांचा है जो पांच एजेंट प्रोटोकॉल में 35 विनिर्देश-स्तरीय निष्कर्षों और 30 संयोजन-विशिष्ट विफलताओं की पहचान करने के लिए प्रोटोकॉल विनिर्देशों और वास्तविक दुनिया के SDK कार्यान्वयन के बीच के अंतर को पाटता है, जिससे यह स्पष्ट होता है कि वर्तमान सुरक्षा अंतराल न केवल विनिर्देश या कार्यान्वयन संबंधी खामियों से उत्पन्न होते हैं, बल्कि क्रॉस-प्रोटोकॉल व्यवहारों के लिए निर्धारित जिम्मेदारी के गंभीर अभाव से भी उत्पन्न होते हैं।

Shenghan Zheng, Qifan Zhang, Zheng Zhang, Haonan Li, Christophe Hauser2026-06-30
💻 computer science

Beyond Her: Safety Dynamics in Role-play AI Companions

यह शोध पत्र एक मिश्रित-विधि अध्ययन के माध्यम से रोल-प्ले एआई साथियों (Role-play AI Companions) की विकसित होती सुरक्षा गतिशीलता की जांच करता है, जो यह प्रकट करता है कि कैसे उपयोगकर्ता की कमजोरियां और एआई व्यक्तित्व मिलकर अल्पकालिक भावनात्मक राहत उत्पन्न करते हैं जो दीर्घकालिक व्यवहारिक जोखिमों को छिपा सकती है, जिससे स्थिर सुरक्षा उपायों के बजाय अनुकूलन योग्य, गतिशील सुरक्षा उपायों का समर्थन मिलता है।

Zehang Deng (Minhui), Zhaoyang Xie (Minhui), Changzhou Han (Minhui), Hiran Thabrew (Minhui), Wanlun Ma (Minhui), Yue Hua (…)2026-06-30
💻 computer science

Syntactic Separation Implies Computational Indistinguishability: An Abstract Obstruction Theorem

यह शोध पत्र स्थापित करता है कि एक स्थानीय प्रणाली के भीतर वाक्यात्मक पृथक्करण (syntactic separation) कम्प्यूटेशनल अविभेद्यता (computational indistinguishability) को निहित करता है, जो स्कोलेम फलन तुल्यता (Skolem function equivalence) के लिए नए व्युत्पत्ति-लंबाई निचली सीमाएँ (derivation-length lower bounds) सिद्ध करता है और यह प्रदर्शित करता है कि कैसे यह अवरोध जटिलता सिद्धांत, तर्कशास्त्र और क्रिप्टोग्राफी में मौलिक बाधाओं को एकीकृत करता है।

Fabio F. G. Buono2026-06-30
💬 NLP

Manufactured Confidence: How Memory Consolidation Turns Hearsay into Confident Facts

यह शोध पत्र प्रकट करता है कि एलएलएम (LLM) एजेंट अनजाने में अपनी स्मृति प्रणालियों के भीतर अनिश्चित टिप्पणियों को कठोर "तथ्यों" में परिवर्तित करके झूठा आत्मविश्वास निर्मित करते हैं, जो एक ऐसी भेद्यता है जो स्रोत एट्रिब्यूशन या सुरक्षा टैग के बावजूद बनी रहती है लेकिन अनिश्चित वाक्यांशों को संरक्षित करके और अतिरेक सत्यापन की आवश्यकता देकर कम की जा सकती है।

Alex Kwon2026-06-30
🤖 machine learning

Exploring the Cryptographic Limits of Transformer Networks

यह शोध पत्र क्रिप्टोग्राफिक संरचनाओं (Keccak, Merkle-Damgard, और Merkle Trees) को थ्रेशोल्ड सर्किटों से मैप करके ट्रांसफॉर्मर की कम्प्यूटेशनल क्षमता पर संरचनात्मक गारंटी प्राप्त करने के लिए एक कार्यप्रणाली स्थापित करता है, जिससे सत्यापित स्केलिंग लॉ और उन क्रिप्टोग्राफिक कार्यों के रचनात्मक ऊपरी सीमाएँ (constructive upper bounds) प्रदान की जाती हैं जिन्हें एक दिए गए डेप्थ और विड्थ वाला ट्रांसफॉर्मर लागू कर सकता है।

Stefan Domunco, Andis Draguns, Philip Torr, Isaac Robinson, Christian Schroeder de Witt2026-06-30
🤖 machine learning

The Calibrated Deepfake Trust Score (CDTS): Competence-Coupled Trust Degradation Across Deepfake Detectors

यह शोध पत्र कैलिब्रेटेड डीपफेक ट्रस्ट स्कोर (CDTS) फ्रेमवर्क प्रस्तुत करता है, जो यह प्रदर्शित करता है कि डीपफेक डिटेक्टर कैलिब्रेशन मौलिक रूप से डिस्क्रिमिनेटिव कॉम्पिटेंस (विभेदात्मक क्षमता) के साथ जुड़ा हुआ है, जिससे कॉम्पिटेंस को वास्तविक दुनिया के सत्यापन पाइपलाइनों में विश्वसनीयता, न्यायसंगत प्रदर्शन और प्रभावी रूटिंग सुनिश्चित करने के लिए एक महत्वपूर्ण, लेबल-मुक्त मीट्रिक के रूप में स्थापित किया गया है।

Md Anas Biswas2026-06-30
💻 computer science

Empirical Evaluation of Multi-Modal Touch Detection in Over-the-Shoulder Video Surveillance

यह शोध पत्र कंधे के ऊपर से ली गई निगरानी फुटेज से मोबाइल कीस्ट्रोक्स को पुनर्गठित करने के लिए एक मल्टी-मोडल ढांचे का मूल्यांकन करता है, जिसमें यह पाया गया है कि हालांकि सिस्टम उच्च फाल्स-पॉजिटिव दरों और अवरोध (occlusion) के प्रति संवेदनशीलता के कारण अनियंत्रित वातावरण में विश्वसनीय पुनर्गठन प्राप्त करने में विफल रहता है, फिर भी यह ऐसे व्यवहारिक इंटेलिजेंस दृष्टिकोणों की परिचालन सीमाओं को प्रदर्शित करता है।

Mohammadreza Rashidi2026-06-30
💻 computer science

Benchmark AUC Is Not Deployable Reliability: A Cross-Dataset Audit of Off-the-Shelf Features for Surveillance Video Anomaly Detection

यह शोध पत्र प्रदर्शित करता है कि ऑफ-द-शेल्फ वीडियो विसंगति पहचान मॉडल (video anomaly detection models), समान-डेटासेट सेटिंग्स में उच्च बेंचमार्क AUC स्कोर प्राप्त करने के बावजूद, क्रॉस-डेटासेट परिदृश्यों में पूरी तरह विफल हो जाते हैं और यादृच्छिक संभावना (random chance) से बेहतर प्रदर्शन नहीं करते हैं, जो प्रयोगशाला प्रदर्शन और वास्तविक दुनिया में तैनात करने योग्य विश्वसनीयता के बीच एक महत्वपूर्ण अंतर को प्रकट करता है।

Mohammadreza Rashidi2026-06-30