💻 computer science

Fast and Lightweight Backdoor Detection via Head Random Probing

यह शोध पत्र HTell को प्रस्तुत करता है, जो एक तेज़ और हल्का, डेटा-मुक्त बैकडोर डिटेक्शन मेथड है जो रैंडम लेटेंट प्रोब्स के तहत प्रेडिक्शन हेड में असामान्य रिस्पॉन्स कंसन्ट्रेशन का विश्लेषण करके समझौता किए गए मॉडल्स की पहचान करता है, और बिना किसी वास्तविक डेटा, ग्रेडिएंट्स या इटरेटिव ऑप्टिमाइज़ेशन के उच्च सटीकता और दक्षता प्राप्त करता है।

Yinbo Yu, Xueyu Yin, Jing Fang, Chunwei Tian, Qi Zhu, Jiajia Liu, Daoqiang Zhang2026-05-20
💻 computer science

DMN: A Compositional Framework for Jailbreaking Multimodal LLMs with Multi-Image Inputs

यह शोध पत्र DMN को पेश करता है, जो एक कंपोजिशनल जेलब्रेक फ्रेमवर्क है जो निर्देशों को वितरित करके, मल्टीमॉडल साक्ष्य प्रदान करके और नंबर चेन कार्यों को जोड़कर मल्टी-इमेज इनपुट का लाभ उठाता है, जिससे अग्रणी मल्टीमॉडल LLMs पर 90% से अधिक हमला सफलता दर प्राप्त की जाती है, जिससे उनके सुरक्षा संरेखण (safety alignment) की महत्वपूर्ण कमजोरियों को उजागर किया जा सके।

Wenzhuo Xu, Zhipeng Wei, Zonghao Ying, Deyue Zhang, Dongdong Yang, Xiangzheng Zhang, Quanchen Zou2026-05-20
💻 computer science

OEP: Poisoning Self-Evolving LLM Agents via Locally Correct but Non-Transferable Experiences

यह शोध पत्र ऑब्सेसिव एक्सपीरियंस पॉइज़निंग (OEP) को प्रस्तुत करता है, जो एक लो-प्रिविलेज ब्लैक-बॉक्स हमला है जो मेमोरी-ऑगमेंटेड LLM एजेंटों को स्थानीय रूप से सही लेकिन गैर-हस्तांतरणीय अनुभवों के साथ समझौता करके बाधित करता है, जिनमें गंभीर काल्पनिक परिणाम शामिल होते हैं, जिससे एजेंट स्व-विकास के दौरान हानिकारक नियमों में अत्यधिक सामान्यीकरण करने लगते हैं।

Kaixiang Wang, Jiong Lou, Zhaojiacheng Zhou, Jie Li2026-05-20
💻 computer science

Concave is the New Linear: The Impossibility of Anti-Plutocratic DAO Governance

यह शोध पत्र यह सिद्ध करता है कि केवल वॉलेट बैलेंस पर आधारित कोई भी मतदान नियम अनुमति रहित (permissionless) DAOs में धनिकतंत्र (plutocratic) के नियंत्रण को प्रभावी ढंग से रोकने में सक्षम नहीं है, क्योंकि सिबिल हमलावर (Sybil attackers) अपने टोकन को कई वॉलेट्स में विभाजित करके ऐसी मतदान शक्ति प्राप्त कर सकते हैं जो उनकी होल्डिंग्स के साथ कम से कम रैखिक रूप से (linearly) बढ़ती है, जिससे क्वाड्रेटिक वोटिंग (Quadratic Voting) जैसे प्रति-धनिकतंत्र तंत्र वास्तविक हमले की लागतों के विरुद्ध व्यावहारिक रूप से अप्रभावी हो जाते हैं।

Austin Bennett, Preston Vander Vos, Duc V. Le, Mira Belenkiy2026-05-20
💻 computer science

Agent Security is a Systems Problem

यह शोधपत्र तर्क देता है कि एजेंट सुरक्षा को एक सिस्टम-स्तरीय समस्या के रूप में माना जाना चाहिए जिसके लिए एआई मॉडल को एक अविश्वसनीय घटक (untrusted component) के रूप में देखा जाना आवश्यक है, और यह इनवेरियंट्स (invariants) को लागू करने तथा उन हमलों को रोकने के लिए स्थापित सिस्टम सुरक्षा सिद्धांतों को अपनाने की वकालत करता है जिन्हें केवल मॉडल मजबूती (model robustness) अकेले संबोधित नहीं कर सकती।

Mihai Christodorescu, Earlence Fernandes, Ashish Hooda, Somesh Jha, Johann Rehberger, Kamalika Chaudhuri, Xiaohan Fu, Kh (…)2026-05-20
💻 computer science

Structural Analysis of Cryptographic Sequences using Stringology-Based Fingerprinting

यह शोध पत्र एक स्ट्रिंगोलॉजी-आधारित फिंगरप्रिंटिंग (SBF) ढांचे को प्रस्तुत करता है जो क्रिप्टोग्राफिक अनुक्रमों के संरचनात्मक पैटर्न का विश्लेषण करता है ताकि उन्हें शुद्ध यादृच्छिक डेटा से अलग करने वाले मापने योग्य हस्ताक्षरों की पहचान की जा सके, जो पारंपरिक सांख्यिकीय परीक्षणों से परे जनरेटर व्यवहार के मूल्यांकन के लिए एक नया दृष्टिकोण प्रदान करता है।

Victor Kebande2026-05-20
💻 computer science

On the Geometric Limits of Transformer Defenses against Obfuscation Attacks: Latent Embedding Collapse & Performance Robustness Gap

यह शोध पत्र प्रकट करता है कि लगभग पूर्ण वर्गीकरण प्रदर्शन प्राप्त करने के बावजूद, मौजूदा प्रॉम्प्ट इंजेक्शन रक्षा प्रणालियाँ एक गंभीर "प्रदर्शन-मजबूती अंतराल" (performance-robustness gap) से ग्रस्त हैं, जहाँ मल्टी-ऑपरेटर ओब्फस्केटेड प्रॉम्प्ट्स के कारण लेटेंट एम्बेडिंग कोलैप्स और ज्यामितीय भंगुरता (geometric fragility) उत्पन्न होती है जिसे मानक मेट्रिक्स पहचानने में विफल रहते हैं।

Becky Mashaido, Tapadhir Das2026-05-20
🤖 AI

Hallucination as Exploit: Evidence-Carrying Multimodal Agents

यह शोध पत्र एविडेंस-कैरिंग मल्टीमॉडल एजेंट्स (ECA) को पेश करता है, जो एक सुरक्षित आर्किटेक्चर है जो मॉडल के अपुष्ट संवेदी दावों पर भरोसा करने के बजाय टूल कॉल्स को टाइप किए गए, बाहरी साक्ष्य प्रमाणपत्रों के विरुद्ध मान्य करने की आवश्यकता के माध्यम से मतिभ्रम-जनित (hallucination-driven) प्राधिकरण विफलताओं को रोकता है।

Guijia Zhang, Hao Zheng, Harry Yang2026-05-20
⚡ electrical engineering

Detecting and Mitigating Backdoor Attacks in OTA-FL Systems: A Two-Stage Robust Aggregation Scheme

यह शोध पत्र एक दो-चरणीय सुदृढ़ एकत्रीकरण ढांचे का प्रस्ताव करता है जो ओवर-द-एयर फेडरेटेड लर्निंग सिस्टम में मुख्य-कार्य सटीकता को बनाए रखते हुए बैकडोर हमलों का प्रभावी ढंग से पता लगाने और उन्हें कम करने के लिए मोडैलिटी-अवेयर ट्रस्ट स्कोरिंग के साथ ट्रस्ट-आधारित मल्टीपल एक्सेस और अनुदैर्ध्य प्रतिष्ठा तंत्रों को जोड़ता है।

Xiaoyan Ma, Seohyun Lee, Taejoon Kim, Christopher G. Brinton2026-05-20
💻 computer science

MultiBallot: Verifiable and privacy-preserving E-Collecting in the Swiss setting

यह शोध पत्र स्विट्जरलैंड में इलेक्ट्रॉनिक हस्ताक्षर संग्रह के लिए एक सुरक्षित, गोपनीयता-संरक्षित और सत्यापन योग्य प्रोटोकॉल का प्रस्ताव करता है, जो बिना किसी गुमनाम चैनल की आवश्यकता के भागीदारी की गोपनीयता सुनिश्चित करने के लिए कई सक्रिय संग्रहों की समानांतर प्रकृति का लाभ उठाता है।

Florian Moser, Léo Louistisserand2026-05-20