🤖 machine learning

Claudini: Autoresearch Discovers State-of-the-Art Adversarial Attack Algorithms for LLMs

यह शोध पत्र प्रदर्शित करता है कि क्लॉड कोड (Claude Code) द्वारा संचालित एक ऑटोरिसर्च पाइपलाइन स्वायत्त रूप से नवीन व्हाइट-बॉक्स एडवरसैरियल अटैक एल्गोरिदम की खोज कर सकती है जो मौजूदा तरीकों से काफी बेहतर प्रदर्शन करते हैं, और अत्याधुनिक एलएलएम (LLM) सुरक्षा उपायों के विरुद्ध 100% तक अटैक सफलता दर प्राप्त करते हैं।

Alexander Panfilov, Peter Romov, Igor Shilov, Yves-Alexandre de Montjoye, Jonas Geiping, Maksym Andriushchenko2026-03-26
💬 NLP

Analysing the Safety Pitfalls of Steering Vectors

यह शोध पत्र व्यवस्थित रूप से प्रदर्शित करता है कि एक्टिवेशन स्टीयरिंग वेक्टर्स, विशेष रूप से कंट्रास्टिव एक्टिवेशन एडिशन से प्राप्त वेक्टर्स, लेटेंट रिफ्यूज़ल डायरेक्शंस (अव्यक्त इनकार दिशाओं) के साथ ओवरलैप होकर, एक भाषा मॉडल की जेलब्रेक हमलों के प्रति संवेदनशीलता को नाटकीय रूप से बदल सकते हैं, जिससे नियंत्रण क्षमता और सुरक्षा के बीच एक महत्वपूर्ण समझौता प्रकट होता है।

Yuxiao Li, Alina Fastowski, Efstratios Zaradoukas, Bardh Prenkaj, Gjergji Kasneci2026-03-26
💻 computer science

Compact and Selective Disclosure for Verifiable Credentials

यह शोध पत्र CSD-JWT को प्रस्तुत करता है, जो एक ओपन-सोर्स तंत्र है जो क्रिप्टोग्राफिक संचयक (cryptographic accumulators) का लाभ उठाकर सत्यापन योग्य क्रेडेंशियल्स (Verifiable Credentials) के संक्षिप्त और चयनात्मक प्रकटीकरण को सक्षम बनाता है, जिससे सेल्फ-सोवरेन आइडेंटिटी सिस्टम के भीतर संसाधन-सीमित उपकरणों के लिए मेमोरी उपयोग और नेटवर्क ओवरहेड में काफी कमी आती है।

Alessandro Buldini, Carlo Mazzocca, Rebecca Montanari, Selcuk Uluagac2026-03-25
💬 NLP

Injecting Falsehoods: Adversarial Man-in-the-Middle Attacks Undermining Factual Recall in LLMs

यह शोध पत्र Xmera को प्रस्तुत करता है, जो एक नवीन प्रतिकूल ढांचा (adversarial framework) है जो यह प्रदर्शित करता है कि मामूली प्रॉम्प्ट इंजेक्शन हमले उच्च सफलता दर के साथ LLM की तथ्यात्मक रिकॉल (factual recall) को गंभीर रूप से कमजोर कर सकते हैं, जबकि एक रैंडम फॉरेस्ट-आधारित रक्षा का प्रस्ताव करता है जो जनरेशन अनिश्चितता (generation uncertainty) का उपयोग करके समझौता किए गए उत्तरों को वैध उत्तरों से प्रभावी ढंग से अलग करता है।

Alina Fastowski, Bardh Prenkaj, Yuxiao Li, Gjergji Kasneci2026-03-25
🤖 machine learning

DP-FedSOFIM: Differentially Private Federated Stochastic Optimization using Regularized Fisher Information Matrix

यह शोध पत्र DP-FedSOFIM का प्रस्ताव करता है, जो एक स्केलेबल डिफरेंशियल प्राइवेट फेडरेटेड लर्निंग पद्धति है जो निजीकृत ग्रेडिएंट्स से प्राप्त एक रेगुलराइज्ड फिशर इंफॉर्मेशन मैट्रिक्स के सर्वर-साइड रैंक-वन अपडेट का लाभ उठाकर कड़े गोपनीयता बजट के तहत अभिसरण (convergence) को त्वरित करती है, जिससे बिना किसी अतिरिक्त गोपनीयता ओवरहेड के हेसियन या फीचर कोवेरियेंस अनुमान की कम्प्यूटेशनल और मेमोरी लागतों से बचा जा सकता है।

Sidhant Nair, Tanmay Sen, Mrinmay Sen, Sayantan Banerjee2026-03-25
💻 computer science

Architecture-Derived CBOMs for Cryptographic Migration: A Security-Aware Architecture Tradeoff Method

यह शोध पत्र SATAM को प्रस्तुत करता है, जो एक सुरक्षा-जागरूक आर्किटेक्चर ट्रेड-ऑफ पद्धति है जो स्थापित ढांचों जैसे कि ATAM और STRIDE को एकीकृत करती है ताकि संदर्भ-समृद्ध, आर्किटेक्चर-आधारित क्रिप्टोग्राफिक बिल ऑफ मटेरियल्स (CBOMs) प्राप्त किए जा सकें, जो पारंपरिक इन्वेंट्री-आधारित दृष्टिकोणों में अनुपस्थित आवश्यक सुरक्षा इरादे और तर्क को कैप्चर करके क्रिप्टोग्राफिक माइग्रेशन प्लानिंग को बेहतर बनाते हैं।

Eduard Hirsch, Kristina Raab2026-03-25
💻 computer science

Model Context Protocol Threat Modeling and Analyzing Vulnerabilities to Prompt Injection with Tool Poisoning

यह शोध पत्र मॉडल कॉन्टेक्स्ट प्रोटोकॉल (MCP) में टूल पॉइज़निंग को एक महत्वपूर्ण क्लाइंट-साइड भेद्यता के रूप में पहचानता है, अनुभवजन्य विश्लेषण के माध्यम से वर्तमान क्लाइंट सुरक्षा उपायों की अपर्याप्तता को प्रदर्शित करता है, और इस प्रकार ऐसे प्रॉम्प्ट इंजेक्शन हमलों के विरुद्ध एआई एजेंट पारिस्थितिकी तंत्र को सुरक्षित करने के लिए एक बहुस्तरीय रक्षा रणनीति का प्रस्ताव करता है।

Charoes Huang, Xin Huang, Ngoc Phu Tran, Amin Milani Fard2026-03-25
💻 computer science

OrgForge-IT: A Verifiable Synthetic Benchmark for LLM-Based Insider Threat Detection

यह शोध पत्र OrgForge-IT को प्रस्तुत करता है, जो एक सत्यापन योग्य सिंथेटिक बेंचमार्क है जो इनसाइडर थ्रेट डिटेक्शन में क्रॉस-आर्टिफैक्ट निरंतरता सुनिश्चित करने के लिए एक नियत सिमुलेशन इंजन का उपयोग करता है, जो दस भाषा मॉडलों के व्यापक मूल्यांकन के माध्यम से मॉडल प्रदर्शन, शोर प्रबंधन और विशिष्ट ट्राइएज पाइपलाइनों की आवश्यकता के बारे में महत्वपूर्ण अंतर्दृष्टि प्रकट करता है।

Jeffrey Flynt2026-03-25
💻 computer science

CTF as a Service: A reproducible and scalable infrastructure for cybersecurity training

यह शोध पत्र प्रोक्समॉक्स (Proxmox), टेराफॉर्म (Terraform), एंसिबल (Ansible) और डॉकर स्वार्म (Docker Swarm) पर निर्मित एक पुनरुत्पादक (reproducible) और स्केलेबल "सीटीएफ एज़ अ सर्विस" (CTF as a Service) प्लेटफॉर्म के डिजाइन, विकास और मूल्यांकन को प्रस्तुत करता है, जो साइबर सुरक्षा प्रशिक्षण चुनौतियों की तैनाती को स्वचालित करने और उन बुनियादी ढांचागत बाधाओं को दूर करने के लिए बनाया गया है जो आमतौर पर शैक्षणिक परिवेश में उनके अपनाने को सीमित करती हैं।

Carlos Jimeno Miguel amd Mikel Izal Azcarate2026-03-25
🤖 machine learning

Adversarial Vulnerabilities in Neural Operator Digital Twins: Gradient-Free Attacks on Nuclear Thermal-Hydraulic Surrogates

यह अध्ययन प्रकट करता है कि न्यूरल ऑपरेटर डिजिटल ट्विन्स परमाणु तापीय-द्रवगतिकी (थर्मल-हाइड्रोलिक) प्रणालियों के लिए 1% से भी कम इनपुट का उपयोग करके होने वाले अदृश्य, ग्रेडिएंट-मुक्त प्रतिकूल हमलों (एडवर्सरियल अटैक्स) के प्रति अत्यंत संवेदनशील हैं, जो विनाशकारी भविष्यवाणी त्रुटियां उत्पन्न कर सकते हैं और तैनाती से पहले मानक सत्यापन से परे मजबूती की गारंटी की आवश्यकता पर प्रकाश डालते हैं।

Samrendra Roy, Kazuma Kobayashi, Souvik Chakraborty, Rizwan-uddin, Syed Bahauddin Alam2026-03-25