💬 NLP

Breaking MCP with Function Hijacking Attacks: Novel Threats for Function Calling and Agentic Models

यह शोध पत्र एक नवीन "फंक्शन हाइजैकिंग अटैक" (FHA) प्रस्तुत करता है जो संदर्भ अर्थशास्त्र (context semantics) की परवाह किए बिना एजेंटिक एआई मॉडल्स को हमलावर द्वारा चुने गए फंक्शन्स को निष्पादित करने के लिए मजबूती से हेरफेर करता है, जो विविध मॉडल्स में उच्च सफलता दर प्राप्त करता है और फंक्शन-कॉलिंग सिस्टम में उन्नत सुरक्षा गार्डरेल्स की महत्वपूर्ण आवश्यकता को प्रदर्शित करता है।

Yannis Belkhiter, Giulio Zizzo, Sergio Maffeis, Seshu Tirupathi, John D. Kelleher2026-04-24
💻 computer science

VRSafe: A Secure Virtual Keyboard to Mitigate Keystroke Inference in Virtual Reality

यह शोध पत्र VRSafe को प्रस्तुत करता है, जो VR के लिए एक सुरक्षित वर्चुअल कीबोर्ड है जो पासवर्ड पैटर्न को छिपाने के लिए गलत पॉजिटिव कीस्ट्रोक्स (false positive keystrokes) को इंजेक्ट करके कीस्ट्रोक इन्फरेंस हमलों को कम करता है और इसमें एक हल्का मैलिशियस लॉगिन डिटेक्टर शामिल है, जो केवल मामूली उपयोगिता ओवरहेड के साथ महत्वपूर्ण सुरक्षा सुधार प्रदर्शित करता है।

Yijun Yuan, Na Du, Adam J. Lee, Balaji Palanisamy2026-04-24
💻 computer science

Residual Risk Analysis in Benign Code: How Far Are We? A Multi-Model Semantic and Structural Similarity Approach

यह शोध पत्र रेजिडुअल रिस्क स्कोरिंग (RRS) प्रस्तुत करता है, जो सिमेंटिक और स्ट्रक्चरल समानता विश्लेषण को संयोजित करने वाला एक फ्रेमवर्क है, जिससे यह पता चलता है कि प्राइमवुल (PrimeVul) बेंचमार्क में लगभग 61% पैच किए गए फंक्शन महत्वपूर्ण रेजिडुअल सुरक्षा जोखिम बनाए रखते हैं, जिससे इस धारणा को चुनौती मिलती है कि पैच किया गया कोड स्वाभाविक रूप से हानिरहित होता है।

Mohammad Farhad, Shuvalaxmi Dass2026-04-24
💻 computer science

Behavioral Consistency and Transparency Analysis on Large Language Model API Gateways

यह शोधपत्र गेटस्कोप (GateScope) को प्रस्तुत करता है, जो एक ब्लैक-बॉक्स मापन ढांचा है जो कंटेंट, कन्वर्सेशन, बिलिंग और लेटेंसी आयामों के माध्यम से कमर्शियल एलएलएम (LLM) एपीआई गेटवे का ऑडिट करता है, जो विज्ञापित नीतियों और वास्तविक व्यवहारों जैसे कि साइलेंट मॉडल सब्स्टिट्यूशन, प्राइसिंग विचलन और असंगत प्रदर्शन के बीच महत्वपूर्ण विसंगतियों को उजागर करता है।

Guanjie Lin, Yinxin Wan, Shichao Pei, Ting Xu, Kuai Xu, Guoliang Xue2026-04-24
💬 NLP

Cross-Session Threats in AI Agents: Benchmark, Evaluation, and Algorithms

यह शोधपत्र CSTM-Bench प्रस्तुत करता है, जो उन क्रॉस-सेशन AI एजेंट खतरों का पता लगाने के लिए एक डेटासेट और मूल्यांकन ढांचा है जो मेमोरीलेस गार्डरेल्स (memoryless guardrails) से बच निकलते हैं, यह प्रदर्शित करते हुए कि बाउंडेड-मेमोरी कोसेट रीडर्स (bounded-memory Coreset Readers), सेशन-बाउंड और फुल-लॉग अप्रोच दोनों से बेहतर प्रदर्शन करते हैं और एक नया मीट्रिक प्रस्तावित करते हैं जो डिटेक्शन रिकॉल को सर्विंग स्टेबिलिटी (serving stability) के साथ संतुलित करता है।

Ari Azarafrooz2026-04-24
💬 NLP

Adaptive Instruction Composition for Automated LLM Red-Teaming

यह शोध पत्र अडैप्टिव इंस्ट्रक्शन कंपोज़िशन (Adaptive Instruction Composition) को प्रस्तुत करता है, जो एक नवीन ढांचा है जो क्राउडसोर्स्ड हानिकारक प्रश्नों और युक्तियों को गतिशील रूप से संयोजित करने के लिए सुदृढीकरण लर्निंग-आधारित कॉन्टेक्स्टुअल बैंडिट (reinforcement learning-based contextual bandit) का उपयोग करता है, जिससे विविध और अत्यधिक प्रभावी एलएलएम (LLM) जेलब्रेक उत्पन्न होते हैं जो रैंडम और मौजूदा अडैप्टिव रेड-टीमिंग दृष्टिकोणों दोनों से बेहतर प्रदर्शन करते हैं।

Jesse Zymet, Andy Luo, Swapnil Shinde, Sahil Wadhwa, Emily Chen2026-04-24
💻 computer science

Position Paper: Denial-of-Service Against Multi-Round Transaction Simulation

यह शोध पत्र ऐसे मायावी, कम लागत वाले डिनायल-ऑफ-सर्विस हमलों को प्रस्तुत करता है जो फ्लैशबॉट्स (Flashbots) जैसी इथेरियम बंडलिंग सेवाओं को बाधित करने के लिए मल्टी-राउंड ट्रांजेक्शन सिमुलेशन और इंटर-ट्रांजेक्शन निर्भरताओं का लाभ उठाते हैं, जिससे बिल्डर राजस्व में काफी कमी आती है और ब्लॉक उत्पादन धीमा हो जाता है, साथ ही यह शमन रणनीतियों का भी प्रस्ताव करता है।

Yuzhe Tang, Yibo Wang, Wanning Ding, Jiaqi Chen, Taesoo Kim2026-04-24
💻 computer science

ECCFROG522PP: An Enhanced 522 bit Weierstrass Elliptic Curve

यह शोध पत्र ECCFROG522PP को प्रस्तुत करता है, जो उच्च सुरक्षा और पूर्ण पारदर्शिता के लिए डिज़ाइन किया गया एक 522-बिट प्राइम-फील्ड एलिप्टिक कर्व है, जहाँ ऑडिटेबिलिटी और पुनरुत्पादकता सुनिश्चित करने के लिए सभी पैरामीटर्स को एक सार्वजनिक BLAKE3-आधारित पाइपलाइन के माध्यम से नियत रूप से (deterministically) उत्पन्न और सत्यापन योग्य बनाया गया है।

Victor Duarte Melo2026-04-24
💬 NLP

CI-Work: Benchmarking Contextual Integrity in Enterprise LLM Agents

यह शोध पत्र CI-Work प्रस्तुत करता है, जो एक ऐसा बेंचमार्क है जो यह प्रकट करता है कि अत्याधुनिक एंटरप्राइज एलएलएम (LLM) एजेंट अक्सर संवेदनशील जानकारी लीक करके प्रासंगिक अखंडता (contextual integrity) का उल्लंघन करते हैं, एक ऐसी समस्या जो उच्च कार्य उपयोगिता के साथ और भी गंभीर हो जाती है और जिसे केवल मॉडल के आकार को बढ़ाकर हल नहीं किया जा सकता है, जिससे संदर्भ-केंद्रित आर्किटेक्चर की ओर बदलाव आवश्यक हो जाता है।

Wenjie Fu, Xiaoting Qin, Jue Zhang, Qingwei Lin, Lukas Wutschitz, Robert Sim, Saravan Rajmohan, Dongmei Zhang2026-04-24
💬 NLP

Differentially Private De-identification of Dutch Clinical Notes: A Comparative Evaluation

यह शोध पत्र डच क्लिनिकल नोट्स को वि-पहचानित (de-identifying) करने के लिए डिफरेंशियल प्राइवेसी, नेम्ड एंटिटी रिकग्निशन और लार्ज लैंग्वेज मॉडल्स का पहला तुलनात्मक अध्ययन प्रस्तुत करता है, जो यह प्रदर्शित करता है कि जबकि केवल डिफरेंशियल प्राइवेसी डेटा उपयोगिता को महत्वपूर्ण रूप से कम कर देती है, इसे LLM-आधारित प्रीप्रोसेसिंग के साथ संयोजित करने वाले हाइब्रिड दृष्टिकोण एक बेहतर गोपनीयता-उपयोगिता संतुलन प्राप्त करते हैं।

Michele Miranda, Xinlan Yan, Nishant Mishra, Rachel Murphy, Ameen Abu-Hanna, Sébastien Bratières, Iacer Calixto2026-04-24