🤖 machine learning

Leak It: A Probabilistic Approach to Training-Data Extraction from Black-Box Language Models

यह शोध पत्र यह तर्क देता है कि ROC-AUC जैसे समग्र सदस्यता अनुमान मेट्रिक्स (aggregate membership inference metrics), ब्लैक-बॉक्स लैंग्वेज मॉडल्स से वर्बेटिम (verbatim) प्रशिक्षण-डेटा निष्कर्षण के गंभीर, क्षमता-निर्भर जोखिम को छिपाते हैं, यह प्रदर्शित करते हुए कि पहचानकर्ताओं या कोड वाले विशिष्ट दस्तावेज़ ब्लाइंड बेसलाइन या डीडुप्लिकेशन के बावजूद बार-बार लीक होते हैं, और "leakit" टूल के माध्यम से एक प्रति-दस्तावेज़ संभाव्य ऑडिट ढांचे (per-document probabilistic audit framework) का प्रस्ताव करता है ताकि इस गोपनीयता हानि को सटीक रूप से मापा जा सके।

Victor Maricato2026-08-04
🤖 AI

Exposed by Design: A Dynamic Security Assessment of Internet-Facing MCP Servers at Scale

यह शोध पत्र इंटरनेट-फेसिंग मॉडल कॉन्टेक्स्ट प्रोटोकॉल (MCP) सर्वरों का पहला बड़े पैमाने पर डायनेमिक सुरक्षा मूल्यांकन प्रस्तुत करता है, जो कोर्वस (Corvus) फ्रेमवर्क के विकास और सैकड़ों प्रोडक्शन इंस्टेंस के विश्लेषण के माध्यम से प्रमाणीकरण की कमी और शेल निष्पादन एक्सपोजर जैसी व्यापक कमजोरियों को उजागर करता है।

Nicolás Padilla2026-08-04
💻 computer science

Reflection, Education, Consistency: Towards Best Ethics Practices At Security And Privacy Conferences

यह शोध पत्र समुदाय के सदस्यों के साक्षात्कार के माध्यम से शीर्ष सुरक्षा और गोपनीयता सम्मेलनों में नैतिकता नीतियों की मिश्रित प्रतिक्रिया और कार्यान्वयन चुनौतियों का परीक्षण करता है, जो अत्यधिक नियमन से बचने और वास्तविक नैतिक जागरूकता को बढ़ावा देने के लिए निरंतर नैतिक शिक्षा और समन्वित समुदाय-व्यापी शासन की महत्वपूर्ण आवश्यकता की पहचान करता है।

Florian Hantke, Rafael Mrowczynski, Til Dralle, Ben Stock2026-08-04
💻 computer science

Auditable Release Control for Pedagogical Leakage in LLM Tutors

यह शोध पत्र एलएलएम (LLM) ट्यूटर्स के लिए एक ऑडिट करने योग्य, प्राधिकरण-जागरूक रिलीज़ नियंत्रण ढांचे को प्रस्तुत करता है जो सख्त मध्यस्थता और घटक एट्रिब्यूशन के माध्यम से पेडागोगिकल लीकेज (समयपूर्व उत्तर प्रकटीकरण) को प्रभावी रूप से समाप्त करता है, हालांकि यह बढ़ी हुई सुरक्षा कम होती उपयोगिता की कीमत पर आती है और सार्वभौमिक सिमेंटिक सुरक्षा की गारंटी नहीं देती है।

Nizam Kadir2026-08-04
💻 computer science

Exploring Usability and Legal Practice: Insights from German Judicial Users of Digital Forensics

यह शोधपत्र डिजिटल फॉरेंसिक को एक सामाजिक-तकनीकी प्रणाली के रूप में अवधारणाबद्ध करता है और, 101 जर्मन न्यायिक पेशेवरों के सर्वेक्षण के माध्यम से, आपराधिक कार्यवाहियों में डिजिटल साक्ष्य की उपयोगिता और प्रभावशीलता को बढ़ाने के लिए वर्कफ़्लो एकीकरण, क्रॉस-डोमेन संचार और हितधारक प्रशिक्षण में सुधार हेतु महत्वपूर्ण आवश्यकताओं की पहचान करता है।

Tobias Hoppmann, Leona Lassak, M. Angela Sasse, Zinaida Benenson2026-08-04
💻 computer science

Robust Watermarks Meet Backdoored Models: Evading Diffusion Semantic Watermarks via Stealthy Backdoor

यह शोधपत्र GhostVAE को प्रस्तुत करता है, जो एक गुप्त बैकडोर हमला है जो लेटेंट डिफ्यूजन मॉडल्स में सिमेंटिक वॉटरमार्क्स से सफलतापूर्वक बचने के लिए वेरिएशनल ऑटोएनकोडर्स के एनकोडर से समझौता करता है और साथ ही हानिरहित छवियों पर उच्च पहचान सटीकता बनाए रखता है, जिससे वर्तमान वॉटरमार्किंग प्रणालियों की एंड-टू-एंड सुरक्षा में महत्वपूर्ण कमजोरियों को उजागर किया जाता है।

Jinyuan Liu, Tianshuo Cong, Pei Li, Tianrui Wang, Xinlei He, Anyu Wang, Xiaoyun Wang2026-08-04
💻 computer science

Improving the Security of Containerized Workloads using Transparency and Traceability Services

यह शोध पत्र एक सत्यापन योग्य कंटेनर वितरण आर्किटेक्चर का प्रस्ताव और मूल्यांकन करता है जो पहचान-बद्ध साइनिंग कुंजियाँ (identity-bound signing keys) उत्पन्न करने, घटनाओं को एक अपेंड-ओनली रजिस्ट्री में रिकॉर्ड करने और समझौता किए गए आर्टिफ़ैक्ट्स की तैनाती को रोकने के लिए नीति-आधारित प्रवेश जांच को लागू करने के लिए एक पारदर्शिता सेवा का उपयोग करके आपूर्ति श्रृंखला सुरक्षा को बढ़ाता है।

Nikos Fotiou, Lefteris Georgiadis, Ignacio Lacalle, George C. Polyzos, Vasilios A. Siris2026-08-04
💻 computer science

Adversarial Attacks in Multi-Agent LLM Pipelines: Unveiling Structural Vulnerabilities in Agentic AI Architectures

यह शोध पत्र सीमा सत्यापन (boundary verification) के अभाव के कारण मल्टी-एजेंट एलएलएम (LLM) पाइपलाइनों में संरचनात्मक कमजोरियों की पहचान और लक्षण वर्णन करता है, जो यह प्रदर्शित करता है कि ये हमले मॉडल-विशिष्ट विफलताओं के बजाय वास्तुशिल्प (architectural) विफलताएं हैं जो वर्तमान मूल्यांकन ढांचों से बच निकलती हैं और पाइपलाइन-स्तरीय सुरक्षा उपायों को आवश्यक बनाती हैं।

Faisal Haque Bappy, Tahrim Hossain, Tarannum Shaila Zaman, Raiful Hasan, Kamrul Hasan, Tariqul Islam2026-08-04
💻 computer science

Safety Invariants for Agents Orchestrating Irreversible State Transitions: A Four-Dimensional Formalism Evaluated on Public Ledgers

यह शोध पत्र एक चार-आयामी औपचारिकता और सात व्युत्पन्न सुरक्षा अपरिवर्तनीयों (safety invariants) को प्रस्तुत करता है ताकि सार्वजनिक लेजर पर अपरिवर्तनीय अवस्था संक्रमण (irreversible state transitions) करने वाले स्वायत्त एजेंटों के लिए "निष्पादन निष्ठा" (execution fidelity) की गारंटी दी जा सके, जो यह सुनिश्चित करता है कि साकार प्रभाव या तो शून्य हों या उपयोगकर्ता द्वारा रेंडर किए गए संक्रमण से सटीक रूप से मेल खाते हों, एक ऐसा ढांचा जिसे प्रतिकूल परिवेशों में मानक बेसलाइन की तुलना में सुरक्षा में महत्वपूर्ण सुधार करने के लिए अनुभवजन्य रूप से मान्य किया गया है।

Zhaoming Yin2026-08-04
💻 computer science

Hardware-rooted attestation for AI-agent evidence: composing IETF RATS with action evidence packages

यह शोध पत्र एक कंपोजिट अटेस्टेशन फ्रेमवर्क का प्रस्ताव और प्रदर्शन करता है जो IETF RATS आर्किटेक्चर के माध्यम से सॉफ्टवेयर-जनरेटेड AI एक्शन एविडेंस पैकेजों को हार्डवेयर-रूटेड ट्रस्ट से बांधता है, जिससे यह सुनिश्चित होता है कि एजेंट आउटपुट विशिष्ट, बिना संशोधित मॉडल संस्करणों और विश्वसनीय प्लेटफॉर्म से उत्पन्न हुए हैं।

Anton Sokolov2026-08-04