💬 NLP

AgentRedBench: Dynamic Redteaming and Integration-Aware Defense for LLM Agents over SaaS Integrations

यह शोध पत्र AgentRedBench प्रस्तुत करता है, जो अप्रत्यक्ष प्रॉम्प्ट इंजेक्शन (indirect prompt injection) के प्रति LLM एजेंटों की उच्च संवेदनशीलता को उजागर करने के लिए 24 एंटरप्राइज SaaS एकीकरणों में 215 परिदृश्यों को कवर करने वाला एक गतिशील रेडटीमिंग बेंचमार्क है, और AgentRedGuard प्रस्तुत करता है, जो एक विशेष रक्षा मॉडल है जो कम फॉल्स-पॉजिटिव दर बनाए रखते हुए हमले की सफलता दर को लगभग 70% से घटाकर 2.4% कर देता है।

Hiskias Dingeto, Will Leeney2026-06-02
⚛️ quantum physics

Multidimensional Reconciliation in Continuous-Variable QKD: Review, Coding Schemes, and Open Source Simulation

यह शोध पत्र निरंतर-चर क्वांटम कुंजी वितरण (continuous-variable quantum key distribution) के लिए बहुआयामी सामंजस्य (multidimensional reconciliation) की समीक्षा करता है, जो मानक बीजगणितीय आयामों से परे उच्च-आयामी निर्माणों पर केंद्रित है, रिवर्स रिकॉन्सिलिएशन (reverse reconciliation) के लिए व्यावहारिक कोडिंग स्कीमें प्रस्तावित करता है, और अत्याधुनिक LDPC कोड का उपयोग करके आयाम, दक्षता और त्रुटि दरों के बीच के व्यापार-बंद (trade-offs) का मूल्यांकन करने के लिए ओपन-सोर्स HDirac सिमुलेशन फ्रेमवर्क प्रस्तुत करता है।

Martial Lucien, Rosio Alexis, Diamanti Eleni, Cassagne Adrien, Gouraud Baptiste2026-06-02
💬 NLP

Ghost Tool Calls: Issue-Time Privacy for Speculative Agent Tools

यह शोध पत्र "घोस्ट टूल कॉल्स" (ghost tool calls) को एक गोपनीयता भेद्यता के रूप में पहचानता है जहाँ अनुमानित टूल इनवोकेशन्स (speculative tool invocations), किसी एजेंट द्वारा किसी शाखा (branch) को प्रतिबद्ध करने से पहले बाहरी पर्यवेक्षकों को उपयोगकर्ता के इरादे को लीक कर देते हैं, और "स्पेक्टिव टूल प्राइवेसी कॉन्ट्रैक्ट्स" (Speculative Tool Privacy Contracts) को एक रनटाइम एब्स्ट्रैक्शन के रूप में प्रस्तावित करता है जो डिस्पैच से पूर्व तर्कों (arguments) और गंतव्यों (destinations) को बदलने या दबाने के लिए इश्यू-टाइम नीतियों को लागू करके इस जोखिम को कम करता है।

Bardia Mohammadi, Lars Klein, Akhil Arora, Laurent Bindschaedler2026-06-02
🤖 AI

SHIELD: Secure Hypernetworks for Incremental Expansion Learning Defense

यह शोध पत्र SHIELD को प्रस्तुत करता है, जो एक नया ढांचा है जो तीव्र प्रतिकूल हमलों (strong adversarial attacks) के तहत प्रमाणित रूप से सुदृढ़ (certifiably robust), स्केलेबल और रिप्ले-मुक्त निरंतर शिक्षण (replay-free continual learning) प्राप्त करने के लिए इंटरवल बाउंड प्रोपेगेशन (Interval Bound Propagation) और एक नई इंटरवल मिक्सअप (Interval MixUp) रणनीति के साथ हाइपरनेटवर्क-आधारित आर्किटेक्चर को जोड़ता है।

Patryk Krukowski, Łukasz Gorczyca, Piotr Helm, Kamil KsiąĊek, Przemysław Spurek2026-06-01
⚡ electrical engineering

Acoustic Simulation Framework for Multi-channel Replay Speech Detection

यह शोध पत्र एक ध्वनिक सिमुलेशन फ्रेमवर्क पेश करता है जो M-ALRAD डिटेक्टर को प्रशिक्षित और मूल्यांकित करने के लिए सार्वजनिक संसाधनों से मल्टी-चैनल रीप्ले स्पीच डेटा उत्पन्न करता है, जो इंटर-चैनल फेज डिफरेंस फीचर्स को शामिल करके वास्तविक प्रशिक्षण डेटा के बिना भी वास्तविक दुनिया के वातावरण में सामान्यीकरण करने की इसकी क्षमता को प्रदर्शित करता है।

Michael Neri, Tuomas Virtanen2026-06-01
🤖 machine learning

From Internal Diagnosis to External Auditing: A VLM-Driven Paradigm for Data-Free Online Backdoor Defense

यह शोध पत्र PRISM का प्रस्ताव करता है, जो एक नवीन डेटा-मुक्त ऑनलाइन बैकडोर डिफेंस फ्रेमवर्क है जो गतिशील प्रोटोटाइप रिफाइनमेंट और एडेप्टिव सांख्यिकीय निगरानी के साथ यूनिवर्सल विजन-लैंग्वेज मॉडल्स का लाभ उठाकर नाजुक आंतरिक मॉडल निदान से मजबूत बाहरी सिमेंटिक ऑडिटिंग की ओर स्थानांतरित होता है ताकि विविध डेटासेट्स और हमले के प्रकारों में अत्याधुनिक सुरक्षा प्राप्त की जा सके।

Binyan Xu, Fan Yang, Xilin Dai, Di Tang, Kehuan Zhang2026-06-01
💻 computer science

GoodVibe: Security-by-Vibe for LLM-Based Code Generation

GoodVibe एक न्यूरॉन-स्तर का फ्रेमवर्क है जो सुरक्षा-महत्वपूर्ण न्यूरॉन्स के एक छोटे, स्थानीयकृत उपसमुच्चय (subset) की पहचान करके और उन्हें चुनिंदा रूप से फाइन-ट्यून करके LLM-आधारित कोड जनरेशन की सुरक्षा को बढ़ाता है, जिससे मौजूदा तरीकों की तुलना में न्यूनतम प्रशिक्षण योग्य मापदंडों और कम्प्यूटेशनल ओवरहेड के साथ महत्वपूर्ण सुरक्षा सुधार प्राप्त होता है।

Maximilian Thang, Lichao Wu, Sasha Behrouzi, Mohamadreza Rostami, Jona te Lintelo, Stjepan Picek, Ahmad-Reza Sadeghi2026-06-01
💻 computer science

Safety and Liveness of Cross-Domain State Preservation under Byzantine Faults: A Mechanized Proof in Isabelle/HOL

यह शोध पत्र एक मैकेनाइज्ड (mechanized) Isabelle/HOL प्रमाण प्रस्तुत करता है जो वैश्विक वित्तीय नियामक आवश्यकताओं के एक व्यापक मॉडल के विरुद्ध सात जेनेरिक लोकेल्स (generic locales) के इंस्टेंशिएशन का उपयोग करते हुए, बायज़ेंटाइन दोषों (Byzantine faults) के तहत क्रॉस-डोमेन नियामक अवस्था संरक्षण के लिए सुरक्षा और जीवंतता (liveness) दोनों गारंटियों को स्थापित करता है।

Jinwook Kim2026-06-01
💻 computer science

Strengthening Polymorphic Prompt Assembling: Dynamic Separator Generation Against Emerging Prompt Injection Attacks

यह शोध पत्र पॉलीमॉर्फिक प्रॉम्प्ट असेंबलिंग (PPA) के लिए एक डायनेमिक सेपरेटर जनरेशन मैकेनिज्म का प्रस्ताव करता है जो स्टैटिक सेपरेटर पूल्स को क्रिप्टोग्राफिक डाइजेस्ट से प्राप्त अद्वितीय, प्रति-अनुरोध कैनरी पेयर्स (canary pairs) से बदल देता है, जो प्रभावी रूप से ब्लास्ट-रेडियस कमजोरियों को समाप्त करता है और मॉडल फाइन-ट्यूनिंग की आवश्यकता के बिना प्रॉम्प्ट इंजेक्शन हमले की सफलता दर को काफी कम कर देता है।

Nima Dorzhiev, Peng Liu2026-06-01
💻 computer science

AdvScene: Rethinking Adversarial Patch Evaluation Through Scene Robustness

यह शोध पत्र AdvScene को प्रस्तुत करता है, जो एक नवीन ढांचा है जो पुनर्निर्मित वास्तविक वातावरण में विभिन्न दृष्टिकोणों और दूरियों में 'सीन रोबस्टनेस' (दृश्य सुदृढ़ता) को मापकर प्रतिकूल पैच (एडवर्सरियल पैच) की वास्तविक दुनिया की प्रभावशीलता का मूल्यांकन करता है, जो 'एडवर्सरियल पैच-टू-सीन एम्बेडिंग' (APSE) नामक एक नई विधि के माध्यम से मौजूदा इमेज-केंद्रित और सिम्युलेटर-आधारित बेंचमार्क की सीमाओं को संबोधित करता है।

Xiaoyong (Brian), Yuan (Emily), Lan (Emily), Zhang2026-06-01