💻 computer science

Distributed Deep Variational Approach for Privacy-preserving Data Release

यह शोध पत्र गॉसियन प्राइवेसी प्रोटेक्टर (GPP) का प्रस्ताव करता है, जो एक वितरित डीप वेरिएशनल फ्रेमवर्क है जो फेडरेटेड लर्निंग को सैनिटाइज्ड, निम्न-आयामी डेटा प्रतिनिधित्व जारी करने में सक्षम बनाता है जो म्यूचुअल इंफॉर्मेशन मिनिमाइजेशन के माध्यम से संवेदनशील विशेषताओं के रिसाव को कम करते हुए उपयोगिता को प्रभावी ढंग से सुरक्षित रखता है।

Zahir Alsulaimawi, Huaping Liu2026-05-06
💻 computer science

Revisiting JBShield: Breaking and Rebuilding Representation-Level Jailbreak Defenses

यह शोध पत्र प्रदर्शित करता है कि JBShield जेलब्रेक डिफेंस अपने अवधारणा-आधारित डिटेक्शन में संरचनात्मक खामियों का फायदा उठाकर एक नए एडेप्टिव अटैक (JB-GCG) के प्रति असुरक्षित है, और एक अधिक सुदृढ़ मल्टी-लेयर रिप्रेजेंटेशन ट्राजेक्टरी वेरिफिकेशन (RTV) डिफेंस का प्रस्ताव करता है जो नए और आगामी एडेप्टिव अटैक्स के विरुद्ध लगभग पूर्ण डिटेक्शन प्राप्त करता है।

Kemal Derya, Berk Sunar2026-05-06
💻 computer science

PIIGuard: Mitigating PII Harvesting under Adversarial Sanitization

Piiguard एक वेबपेज-स्तरीय रक्षा तंत्र है जो अनुकूलित छिपे हुए HTML अंशों का उपयोग करता है ताकि LLMs को संपर्क संबंधी PII (व्यक्तिगत पहचान योग्य सूचना) का खुलासा करने से दूर रखा जा सके, जिससे सौहार्दपूर्ण प्रश्नों के लिए उपयोगिता बनाए रखते हुए डेटा रिसाव को रोकने में उच्च सफलता दर प्राप्त की जा सके।

Mingshuo Liu, Yiwei Zha, Min Chen2026-05-06
💻 computer science

Evaluating Retrieval-Augmented Generation for Explainable Malware Analysis

यह शोध पत्र अनुभवजन्य रूप से यह प्रदर्शित करता है कि रिट्रीवल-ऑगमेंटेड जनरेशन (RAG) अक्सर शोर और अप्रासंगिक संदर्भ पेश करके मैलवेयर स्पष्टीकरण की गुणवत्ता को कम कर देता है, जो यह सुझाव देता है कि जब संरचित साक्ष्य पहले से ही उपलब्ध हों, तो मैलवेयर विश्लेषण को ज्ञान-प्राप्ति (knowledge-retrieval) की समस्या के बजाय एक सिग्नल-एक्सट्रैक्शन कार्य के रूप में माना जाना बेहतर है।

Jayson Ng, Amin Milani Fard2026-05-06
💻 computer science

HackerSignal: A Large-Scale Multi-Source Dataset Linking Hacker Community Discourse to the CVE Vulnerability Lifecycle

यह शोधपत्र HackerSignal प्रस्तुत करता है, जो एक बड़े पैमाने का, बहु-स्रोत डेटासेट है जो 1990 से 2026 तक के 7.45 मिलियन दस्तावेज़ों को एकत्रित करता है ताकि हैकर समुदाय की चर्चा को पूर्ण CVE भेद्यता जीवनचक्र (vulnerability lifecycle) से जोड़ा जा सके, जो टेम्पोरल आउट-ऑफ-डिस्ट्रीब्यूशन साइबर थ्रेट इंटेलिजेंस और क्रॉस-सोर्स CVE लिंकेज कार्यों के लिए एक बेंचमार्क के रूप में कार्य करता है।

Benjamin M. Ampel, Sagar Samtani2026-05-06
💻 computer science

A Validated Prompt Bank for Malicious Code Generation: Separating Executable Weapons from Security Knowledge in 1,554 Consensus-Labeled Prompts

यह शोध पत्र एक मान्य 1,554-प्रॉम्प्ट "CODE" बैंक और एक सर्वसम्मति-लेबल वाली वर्गीकरण रूपरेखा प्रस्तुत करता है जो मौजूदा भाषा मॉडल सुरक्षा बेंचमार्क में निहित संलयन संबंधी समस्याओं को संबोधित करने के लिए निष्पादन योग्य दुर्भावनापूर्ण सॉफ़्टवेयर अनुरोधों को हानिकारक सुरक्षा ज्ञान प्रश्नों से कठोरता से अलग करता है।

Richard J. Young, Gregory D. Moody2026-05-06
💻 computer science

Dependency-Aware Privacy for Multi-turn Agents

RootGuard मल्टी-टर्न LLM एजेंटों के लिए एक नवीन गोपनीयता ढांचा (privacy framework) है जो निजी रूट मानों (root values) को एक बार सैनिटाइज़ करता है और उसके बाद के आउटपुट को नियत रूप से (deterministically) व्युत्पन्न करता है, जिससे टर्न के दौरान गोपनीयता क्षरण को रोका जा सकता है और मौजूदा स्वतंत्र नॉइज़िंग विधियों की तुलना में काफी बेहतर गोपनीयता-उपयोगिता ट्रेड-ऑफ प्राप्त किया जा सकता है।

Divyam Anshumaan, Sarthak Choudhary, Nils Palumbo, Somesh Jha2026-05-06
💻 computer science

When Agents Handle Secrets: A Survey of Confidential Computing for Agentic AI

यह सर्वेक्षण इस बात का परीक्षण करता है कि कैसे कॉन्फिडेंशियल कंप्यूटिंग, विशेष रूप से ट्रस्टेड एक्जीक्यूशन एनवायरनमेंट के माध्यम से, हार्डवेयर प्लेटफॉर्म के एक एकीकृत वर्गीकरण, एक एजेंट-केंद्रित थ्रेट मॉडल और सुरक्षात्मक उपायों के तुलनात्मक विश्लेषण प्रदान करते हुए, एजेंटिक एआई सिस्टम द्वारा सामना किए जाने वाले अद्वितीय सुरक्षा खतरों का समाधान करती है, साथ ही एक सुसंगत एंड-टू-एंड सुरक्षा ढांचे की आवश्यकता पर भी प्रकाश डालती है।

Javad Forough, Marios Kogias, Hamed Haddadi2026-05-06
💻 computer science

MAGE: Safeguarding LLM Agents against Long-Horizon Threats via Shadow Memory

यह शोध पत्र MAGE को प्रस्तुत करता है, जो एक नवीन रक्षात्मक ढांचा (defensive framework) है जो सुरक्षा-महत्वपूर्ण संदर्भ (safety-critical context) को सक्रिय रूप से संकुचित करने और LLM एजेंटों में दीर्घकालिक खतरों (long-horizon threats) का पता लगाने के लिए एक समर्पित "शैडो मेमोरी" (shadow memory) का लाभ उठाता है, जिससे नगण्य ओवरहेड के साथ उच्च पहचान सटीकता प्राप्त होती है।

Yuhui Wang, Tanqiu Jiang, Jiacheng Liang, Charles Fleming, Ting Wang2026-05-06
💻 computer science

Cryptographic Registry Provenance: Structural Defense Against Dependency Confusion in AI Package Ecosystems

यह शोध पत्र एक क्रिप्टोग्राफिक रजिस्ट्री प्रोवेनेंस सिस्टम का प्रस्ताव करता है जो सॉफ्टवेयर वितरण में संरचनात्मक अंतराल को समाप्त करने के लिए अनिवार्य पब्लिशर और रजिस्ट्री डुअल-सिग्नेचर के साथ-साथ कंज्यूमर-साइड क्रिप्टोग्राफिक प्रवर्तन को लागू करके AI पैकेज इकोसिस्टम में डिपेंडेंसी कन्फ्यूजन हमलों से बचाव करता है।

Alan L. McCann2026-05-06