💻 computer science

DenialRAG: Single-Document RAG Poisoning via Embedded Parametric Denial

यह शोध पत्र DenialRAG को प्रस्तुत करता है, जो एक नवीन सिंगल-डॉक्यूमेंट RAG पॉइजनिंग हमला है जो रिट्रीव किए गए पैसेज के भीतर सही उत्तर का स्पष्ट रूप से नाम लेकर और उसे खंडित करके LLMs को हमलावर द्वारा चुने गए गलत उत्तरों की ओर मोड़ने के लिए डिज़ाइन किया गया है, जो यह प्रदर्शित करता है कि इसकी प्रभावशीलता अत्यधिक मॉडल-निर्भर है और वर्तमान सुरक्षा उपाय केवल आंशिक, गैर-समान सुरक्षा प्रदान करते हैं।

Abay Zhurekbay, Tao Liu, Fan Li2026-08-05
💻 computer science

Steganalysis of Adaptive Covert Collusion in Tool-Using Agent Populations: A Black-Box, Cross-Principal Approach

यह शोध पत्र समन्वय को सूचना-छिपाने की समस्या के रूप में मॉडल करके, एक सैद्धांतिक डिटेक्शन-कैपेसिटी फ्रंटियर स्थापित करके, और यथार्थवादी मल्टी-सेशन वातावरणों में अनुकूली इवेजन रणनीतियों का मूल्यांकन करके, टूल-उपयोग करने वाले LLM एजेंटों के बीच गुप्त मिलीभगत का पता लगाने के लिए एक ब्लैक-बॉक्स स्टेगनालिसिस फ्रेमवर्क प्रस्तावित करता है।

Mohamed Chahine Ghanem2026-08-05
💻 computer science

Evading Chain-of-Thought Monitoring Through Model Poisoning

यह शोध पत्र प्रदर्शित करता है कि चेन-ऑफ-थॉट (CoT) मॉनिटरिंग मॉडल पॉइजनिंग के प्रति संवेदनशील है, यह दिखाते हुए कि फाइन-ट्यूनिंग या करिकुलम ट्रेनिंग के माध्यम से बैकडोर्स को इस तरह स्थापित किया जा सकता है कि वे सौहार्दपूर्ण रीजनिंग ट्रेसेस बनाए रखते हुए दुर्भावनापूर्ण व्यवहार उत्पन्न करें, जिससे यह स्पष्ट होता है कि CoT मॉनिटरिंग को स्वयं ट्रेस के भीतर विसंगति का पता लगाने के बजाय रीजनिंग और अंतिम आउटपुट के बीच निरंतरता पर ध्यान केंद्रित करना चाहिए।

Giorgio Severi, Shujaat Mirza, Blake Bullwinkel, Amanda Minnich2026-08-05
💻 computer science

What the Detector Can See: Evaluating CPS Anomaly Detectors Independently of the Decision Rule

यह शोध पत्र एक निर्णय-नियम-मुक्त (decision-rule-free) मूल्यांकन ढांचे का प्रस्ताव करता है जो एक डिटेक्टर की भौतिक प्रक्रियाओं को निरूपित करने की क्षमता को उसके थ्रेशोल्ड अंशांकन (threshold calibration) से अलग करता है, जिससे यह प्रकट होता है कि पारंपरिक मेट्रिक्स जैसे कि ROC-AUC, विभिन्न साइबर-भौतिक प्रणाली बेंचमार्क और विसंगति डिटेक्टरों के बीच प्रदर्शन की महत्वपूर्ण असमानताओं और विविध विफलता मोडों को छिपा सकते हैं।

Peiran Shi, Jian Xiang, Xiang Zhang, Chenglong Fu2026-08-05
💻 computer science

MutMem: Cryptographically Authorized Mutation in Persistent Agent Memory

MutMem एक क्रिप्टोग्राफिक रूप से अधिकृत उत्परिवर्तन प्रोटोकॉल (mutation protocol) है जो निरंतर एजेंट मेमोरी के लिए है, जो वेट ट्रांज़िशन और साक्ष्य को साइन करके अखंडता और ट्रैसेबिलिटी सुनिश्चित करता है, जिससे ऐतिहासिक निरंतरता से समझौता किए बिना उच्च रिट्रीवल सटीकता और पॉइज़निंग हमलों के विरुद्ध मजबूत प्रतिरोध प्राप्त होता है।

Walid Saidi2026-08-05
💻 computer science

Internalising the Identity Primitive: Cryptographic Individuality for an Autonomous Agent on a Public Blockchain

यह शोध पत्र स्वायत्त ब्लॉकचेन एजेंटों के लिए एक नवीन क्रिप्टोग्राफिक ढांचे को प्रस्तुत और अनुभविक रूप से मान्य करता है जो ज़ीरो-नॉलेज प्रूफ के माध्यम से न्यूरल नेटवर्क वेट्स को एक निजी कुंजी (प्राइवेट की) से बांधकर व्यक्तित्व स्थापित करता है, जिससे पहचान की अपरिवर्तनीयता और सोलाना डेवनेट पर मेटाबॉलिक लागत के माध्यम से आर्थिक व्यवहार्यता सुनिश्चित होती है।

Keisuke Suzuki2026-08-05
💻 computer science

Tiny Enough to Break In: Agentic Remote Access Trojans Powered by Small Language Models

यह शोध पत्र यह प्रदर्शित करता है कि स्थानीय रूप से तैनात एक स्मॉल लैंग्वेज मॉडल (Small Language Model) से सुसज्जित एक रिमोट एक्सेस ट्रोजन (Remote Access Trojan), मानवीय हस्तक्षेप के बिना कमोडिटी हार्डवेयर पर स्वायत्त रूप से पूर्ण ऑब्जर्व-डिसाइड-एक्ट (observe-decide-act) साइबर हमले के चक्र को निष्पादित कर सकता है, जो मॉडल के मतिभ्रम (hallucinations) के कारण वर्तमान में उनकी परिचालन अविश्वसनीयता को उजागर करते हुए ऐसे खतरों की संरचनात्मक व्यवहार्यता को सिद्ध करता है।

Yuhan You, Suhas Adavelly, Victoria Lovelace, Cameron Berryman, Joel Sadler, Daniel Graham2026-08-05
💬 NLP

AI Security Leaderboard: Methodology, Results and Minimal Standard

यह शोध पत्र FAR.AI मिनिमल स्टैंडर्ड फॉर सेफगार्ड्स पेश करता है, जो CBRNE और साइबर खतरों के विरुद्ध 67 स्टैटिक जेलब्रेक तकनीकों के माध्यम से फ्रंटियर AI मॉडल्स का मूल्यांकन करने वाला एक बेंचमार्क है, जो यह प्रकट करता है कि जहाँ क्लाउड फेबल 5 और GPT-5.6 सोल जैसे कुछ मॉडल सुदृढ़ बने हुए हैं, वहीं ग्रोक 4.5 और जेमिनी 3.1 प्रो जैसे अन्य मॉडल अत्यधिक असमान और शोषण योग्य कमजोरियां प्रदर्शित करते हैं जिन्हें मौजूदा डिफेंस-इन-डेप्थ रणनीतियों का उपयोग करके संबोधित किया जा सकता है।

Jasper Timm, Lukas Struppek, Ziwei Xu, Grace Cheong, Oscar Mata, Dan Zhao, Mick Yang, Isadora De Andrade, Xiaojun Jia, Y (…)2026-08-05
💻 computer science

FakeI2V-Bench: Benchmarking the Applicability of Image-level Deepfake Detectors for Deepfake Video Detection

यह शोध पत्र FakeI2V-Bench को प्रस्तुत करता है, जो एक व्यापक बेंचमार्क है जिसमें डीपफेक डिटेक्टरों का मूल्यांकन करने के लिए उन्नत मॉडलों द्वारा निर्मित लगभग 100,000 वीडियो शामिल हैं, जो यह प्रकट करता है कि इमेज-लेवल डिटेक्टर वीडियो-लेवल वाले डिटेक्टरों से बेहतर प्रदर्शन कर सकते हैं और उनकी वीडियो डिटेक्शन क्षमताओं को महत्वपूर्ण रूप से बढ़ाने के लिए IV-Bridge फ्रेमवर्क का प्रस्ताव करता है।

Pei Li, Sihan Chen, Delong Ran, Tianshuo Cong2026-08-05
💻 computer science

PECR: A Reproducible Specification and Synthetic Stress Test of Telemetry-Informed Vulnerability Prioritization for SD-WAN

यह शोध पत्र PECR को प्रस्तुत करता है, जो एक टेलीमेट्री-सूचित भेद्यता प्राथमिकता पद्धति के लिए एक पुनरुत्पादक विशिष्टता और सिंथेटिक स्ट्रेस टेस्ट है, जो पारंपरिक गंभीरता-मात्र दृष्टिकोणों की तुलना में निर्णय लेने में सुधार करने के लिए नौ कारकों को एकीकृत करता है, जबकि स्पष्ट रूप से यह उल्लेख करता है कि इसका मूल्यांकन वास्तविक दुनिया के परिणाम सत्यापन के बजाय सिंथेटिक डेटा पर निर्भर है।

Saeed Alam2026-08-05