💬 NLP

RedAct: Redacting Agent Capability Traces for Procedural Skill Protection

यह शोध पत्र RedAct को प्रस्तुत करता है, जो एक ऐसा ढांचा है जो ऑडिट साक्ष्य को संरक्षित करते हुए संवेदनशील जानकारी को चुनिंदा रूप से हटाकर (redact करके) AI एजेंट निष्पादन ट्रेसेस (execution traces) में प्रक्रियात्मक कौशल की रक्षा करता है, जिससे जवाबदेही से समझौता किए बिना अनधिकृत कौशल हस्तांतरण को प्रभावी ढंग से रोका जा सकता है।

Shuwen Xu (May), Zhitao He (May), Yi R. (May), Fung2026-06-10
💬 NLP

Training LLMs to Enforce Multi-Level Instruction Hierarchies via Gravity-Weighted Direct Preference Optimization

यह शोध पत्र ग्रेविटी-वेटेड डायरेक्ट प्रेफरेंस ऑप्टिमाइज़ेशन (GW-DPO) प्रस्तुत करता है, जो एक नवीन प्रशिक्षण उद्देश्य है जिसे विशिष्ट डेलीमिटर टोकन और एम्बेडिंग्स के साथ जोड़ा गया है ताकि LLMs में पांच-स्तरीय निर्देश पदानुक्रम को प्रभावी ढंग से लागू किया जा सके, जिससे विभिन्न विश्वास स्तरों वाले निर्देशों के बीच संघर्षों को हल किया जा सके और मानक दृष्टिकोणों की तुलना में ओवर-रिफ्यूज़ल (अत्यधिक इनकार) को काफी कम किया जा सके।

Lena S. Bolliger, Lena A. Jäger2026-06-10
💻 computer science

A Longitudinal Study of Recently Observed Malicious Domains: Characteristics, Infrastructure, and Abuse Patterns

यह शोध पत्र जनवरी और मई 2026 के बीच VirusTotal पर देखे गए 1.52 मिलियन दुर्भावनापूर्ण डोमेन का एक अनुदैर्ध्य विश्लेषण प्रस्तुत करता है, जो अल्पकालिक हमलावर-निर्मित डोमेन, विशिष्ट रजिस्ट्रार और फ्रंटिंग के लिए क्लाउडफ्लेयर (Cloudflare) पर भारी निर्भरता, व्यापक थोक पंजीकरण, और महत्वपूर्ण ब्रांड प्रतिरूपण जैसे रुझानों को उजागर करने के लिए आठ आयामों में उनके बुनियादी ढांचे और दुरुपयोग पैटर्न को अभिलक्षित करता है।

Fathima Mashood, Mohamed Nabeel2026-06-10
🤖 AI

FIT-Print: Towards False-claim-resistant Model Ownership Verification via Targeted Fingerprint

यह शोध पत्र FIT-Print को प्रस्तुत करता है, जो एक लक्षित मॉडल फिंगरप्रिंटिंग फ्रेमवर्क है जो विविध पुन: उपयोग तकनीकों के विरुद्ध 100% स्वामित्व सत्यापन सटीकता बनाए रखते हुए, झूठे दावे वाले हमलों को प्रभावी ढंग से बेअसर करता है और स्वतंत्र मॉडलों पर होने वाली गलत सूचनाओं (फॉल्स अलार्म) को समाप्त करता है।

Shuo Shao, Haozhe Zhu, Yiming Li, Hongwei Yao, Tianwei Zhang, Zhan Qin2026-06-09
🤖 machine learning

Robust In-Context Reinforcement Learning Under Reward Poisoning Attacks

यह शोधपत्र एडवर्सियली ट्रेंड डीपीटी (AT-DPT) का प्रस्ताव करता है, जो एक नवीन ढांचा है जो रिवॉर्ड पॉइजनिंग हमलों के विरुद्ध सुदृढ़ इन-कॉन्टेक्स्ट सुदृढीकरण सीखने (reinforcement learning) को प्राप्त करने के लिए एक डिसीजन-प्रिट्रेंड ट्रांसफॉर्मर और हमलावरों की एक जनसंख्या को एक साथ प्रशिक्षित करता है, जो बैंडिट और जटिल एमडीपी (MDP) वातावरण दोनों में मानक बेसलाइन की तुलना में बेहतर प्रदर्शन प्रदर्शित करता है।

Paulius Sasnauskas, Yiğit Yalın, Goran Radanović2026-06-09
💬 NLP

Efficient and Stealthy Jailbreak Attacks via Adversarial Prompt Distillation from LLMs to SLMs

यह शोध पत्र एडवर्सरियल प्रॉम्प्ट डिस्टिलेशन (APD) को प्रस्तुत करता है, जो एक नवीन ढांचा है जो नॉलेज डिस्टिलेशन और रिइन्फोर्समेंट लर्निंग के माध्यम से बड़े भाषा मॉडलों से छोटे भाषा मॉडलों में जेलब्रेकिंग क्षमताओं को स्थानांतरित करता है, जिससे काफी बेहतर दक्षता और कम कम्प्यूटेशनल लागत के साथ अत्याधुनिक अटैक सक्सेस रेट्स प्राप्त होते हैं।

Xiang Li, Chong Zhang, Jia Wang, Fangyu Wu, Yushi Li, Xiaobo Jin2026-06-09
🤖 machine learning

Cryptographic Backdoor for Neural Networks: Boon and Bane

यह शोध पत्र यह प्रदर्शित करता है कि न्यूरल नेटवर्क में क्रिप्टोग्राफिक बैकडोर्स एक दोहरे उद्देश्य वाले उपकरण के रूप में कार्य कर सकते हैं, जो शक्तिशाली, अप्राप्य प्रतिकूल हमलों (adversarial attacks) को सक्षम करने के साथ-साथ वॉटरमार्किंग, प्रमाणीकरण और बौद्धिक संपदा ट्रैकिंग के लिए प्रमाणित रूप से सुदृढ़ तंत्र प्रदान करते हैं, जिसका अत्याधुनिक आर्किटेक्चर पर अनुभवजन्य सत्यापन और पोस्ट-क्वांटम क्रिप्टोग्राफी तक संभावित विस्तार किया गया है।

Anh Tu Ngo, Anupam Chattopadhyay, Subhamoy Maitra2026-06-09
💻 computer science

Security Analysis of LTE Connectivity in Connected Cars: A Case Study of Tesla

यह शोध पत्र टेस्ला के मॉडल 3 और साइबरट्रक का एक ब्लैक-बॉक्स सुरक्षा विश्लेषण प्रस्तुत करता है, जो IMSI कैचिंग, रोग बेस स्टेशन हाइजैकिंग और असुरक्षित फॉलबैक तंत्र जैसी महत्वपूर्ण LTE कमजोरियों को उजागर करता है, जो कनेक्टेड वाहनों को सुरक्षा जोखिमों के प्रति संवेदनशील बनाते हैं और मौजूदा ऑटोमोटिव नियामक ढांचों को चुनौती देते हैं।

Evangelos Bitsikas, Jason Veara, Aanjhan Ranganathan2026-06-09
💻 computer science

Future-Proofing Authentication Against Insecure Bootstrapping for 5G Networks: Feasibility, Resiliency, and Accountability

यह शोध पत्र BORG को प्रस्तुत करता है, जो 5G नेटवर्क के लिए एक भविष्योन्मुखी (future-proof) प्रमाणीकरण ढांचा है, जो एक पदानुक्रमित पहचान-आधारित थ्रेशोल्ड सिग्नेचर (Hierarchical Identity-Based Threshold Signature) योजना का उपयोग करके प्रत्यक्ष पोस्ट-क्वांटम क्रिप्टोग्राफी अपनाने की अव्यवहारिकता को दूर करता है ताकि सख्त पैकेट-आकार और विलंबता सीमाओं के भीतर वितरित विश्वास, सत्यापन योग्य जालसाजी का पता लगाने की क्षमता और क्वांटम-प्रतिरोधी सुरक्षा प्रदान की जा सके।

Saleh Darzi, Mirza Masfiqur Rahman, Imtiaz Karim, Rouzbeh Behnia, Attila A Yavuz, Elisa Bertino2026-06-09
💻 computer science

RunPBA -- Runtime attestation for microcontrollers with PACBTI

यह शोध पत्र RunPBA प्रस्तुत करता है, जो Arm Cortex-M माइक्रोकंट्रोलर्स के लिए नए PACBTI प्रोसेसर एक्सटेंशन का लाभ उठाने वाला एक हार्डवेयर-आधारित रनटाइम अटस्टेशन सिस्टम है, जो न्यूनतम प्रदर्शन ओवरहेड के साथ और बिना किसी हार्डवेयर संशोधन की आवश्यकता के कंट्रोल फ्लो हमलों से प्रभावी ढंग से बचाव करता है।

André Cirne, Patrícia R. Sousa, João S. Resende, Luís Antunes2026-06-09