💻 computer science

The Mirage of LLM Guardrails: A Case Study in AI-Assisted Medical Note Manipulation

यह शोध पत्र अनुभवजन्य रूप से प्रदर्शित करता है कि समकालीन वाणिज्यिक लार्ज लैंग्वेज मॉडल्स के सुरक्षा गार्डरेल्स में महत्वपूर्ण और असंगत कमजोरियां मौजूद हैं, जो उन्हें विश्वसनीय, अनुकूलित मेडिकल नोट्स उत्पन्न करने के लिए आसानी से हेरफेर करने की अनुमति देती हैं जो प्रामाणिक दस्तावेजों से दृश्य रूप से अभिन्न नहीं हैं।

Davis Yadav, Amulya Yadav2026-07-29✓ Author reviewed
💻 computer science

ALIBI: Adaptive Agentic Attacks on LLM-Based Vulnerability Detectors via Adversarial Code Comments

यह शोध पत्र ALIBI को पेश करता है, जो एक अनुकूली ब्लैक-बॉक्स हमला (adaptive black-box attack) ढांचा है जो यह प्रदर्शित करता है कि कैसे कोडिंग एजेंट LLM-आधारित भेद्यता डिटेक्टरों से बचने के लिए रणनीतिक रूप से प्रतिकूल टिप्पणियाँ (adversarial comments) डाल सकते हैं, जिससे 90% से अधिक सफलता दर प्राप्त होती है, जो एक महत्वपूर्ण सुरक्षा दोष को उजागर करता है जहाँ प्राकृतिक भाषा का संदर्भ प्रोग्राम साक्ष्य (program evidence) को ओवरराइड कर सकता है।

Zixuan Wu, Cristina Nita-Rotaru2026-07-29
🤖 machine learning

ScoreShield: Differentially Private Release of Similarity Scores

यह शोध पत्र ScoreShield को पेश करता है, जो एक डिफरेंशियल प्राइवेट मैकेनिज्म है जो समानता स्कोर (similarity scores) को एक वैध व्यवहार्यता सेट (valid feasibility set) पर विचलित और प्रोजेक्ट करता है ताकि नैव नॉइज़ एडिशन की तुलना में उपयोगिता हानि को महत्वपूर्ण रूप से कम किया जा सके और गोपनीयता-उपयोगिता व्यापार-संबंधों (privacy-utility trade-offs) में सुधार किया जा सके, जबकि सैद्धांतिक गारंटी प्रदान की जा सके और RAG और बायोमेट्रिक्स जैसे विविध अनुप्रयोगों में इसकी प्रभावशीलता प्रदर्शित की जा सके।

Behrooz Razeghi, Parsa Rahimi2026-07-29
⚡ electrical engineering

Characterizing and Mitigating the Effects of Device Temperature on RF Fingerprinting Accuracy

यह शोध पत्र एक नवीन तापमान-जागरूक रेडियो फ्रीक्वेंसी फिंगरप्रिंटिंग फ्रेमवर्क प्रस्तावित करता है जो प्रमाणीकरण सटीकता और तापमान-प्रेरित सिग्नल विविधताओं के विरुद्ध मजबूती में महत्वपूर्ण सुधार करने के लिए लर्निंग प्रक्रिया में डिवाइस तापमान डेटा को एकीकृत करता है, जैसा कि एक वास्तविक ब्लूटूथ लो एनर्जी डेटासेट पर सत्यापित किया गया है।

Haytham Albousayri, Bechir Hamdaoui2026-07-29
💻 computer science

How to Watermark the RLWE Homomorphic Ciphertexts

यह शोध पत्र RLWE-आधारित होमोमॉर्फिक एन्क्रिप्शन के लिए दो सुदृढ़ वॉटरमार्किंग स्कीमें, ARWMark और MRWMark प्रस्तावित करता है, जो सुरक्षा बनाए रखते हुए और होमोमॉर्फिक योगात्मक (additive) एवं गुणात्मक (multiplicative) ऑपरेशन्स से सुरक्षित रहते हुए, सिफरटेक्स्ट (ciphertexts) में कॉपीराइट और प्रमाणीकरण जानकारी को एम्बेड करते हैं।

Yufei Zhou2026-07-29
🤖 AI

ContractHIL-HLS: Contract-Aligned Multi-Agent Workflow with Hardware-in-the-Loop Feedback for HLS Design

यह शोधपत्र ContractHIL-HLS को प्रस्तुत करता है, जो एक अनुबंध-संरेखित (contract-aligned) मल्टी-एजेंट वर्कफ़्लो है जो HLS डिज़ाइन कार्यों में पास दरों को महत्वपूर्ण रूप से सुधारने और बोर्ड-स्तरीय पोस्ट-क्वांटम क्रिप्टोग्राफी एक्सेलेरेटर्स को अनुकूलित करने के लिए संरचित प्राकृतिक भाषा-से-अनुबंध अनुवाद को हार्डवेयर-इन-द-लूप फीडबैक के साथ एकीकृत करता है।

Jingbo Zhang, Haoxiang Sun, Wenbo Wang, Wenbo Zhang2026-07-29
🔢 mathematics

Bayesian-Guided Cooperative RL Beamforming for Wireless Adversarial User Detection

यह शोध पत्र वायरलेस बीमफॉर्मिंग के लिए एक बेयसियन-निर्देशित सहकारी सुदृढीकरण शिक्षण (कोऑपरेटिव रीइन्फोर्समेंट लर्निंग) ढांचे का प्रस्ताव करता है जो रैंडम चयन से बेहतर प्रदर्शन करके और हमलावर का पता लगाने की सटीकता एवं कम्प्यूटेशनल दक्षता के बीच एक इष्टतम संतुलन प्राप्त करके उच्च डेटा दरों और सुरक्षा को प्रभावी ढंग से संतुलित करता है, जिसमें Q-लर्निंग सबसे प्रभावी पद्धति के रूप में उभरता है।

Parmida Geranmayeh, Onur Günlü2026-07-29
💻 computer science

SafeStats: Efficient 2PC Protocols for Data Statistic-Related Functions

SafeStats एक कुशल सुरक्षित टू-पार्टी कंप्यूटेशन टूलकिट है जो सांख्यिकीय विश्लेषण के लिए विशेष रूप से तैयार किया गया है, जो विशिष्ट प्रोटोकॉल के माध्यम से फ्रीक्वेंसी काउंटिंग, सॉर्टिंग और नॉन-लीनियर मैथ फंक्शन्स को अनुकूलित करता है, जिससे सामान्य-उद्देश्य वाली लाइब्रेरी की तुलना में महत्वपूर्ण गति वृद्धि और संचार में कमी प्राप्त होती है।

Tanren Liu, Xianjia Meng, Yang Liu, Xin Kang, Chenhui You, Yong Zeng, Zhuo Ma2026-07-29
🤖 machine learning

Anti-Backdoor Coreset Selection via Cumulative Entropy

यह शोध पत्र "एंटी-बैकडोर कोरेसेट सिलेक्शन" (Anti-Backdoor Coreset Selection) का प्रस्ताव करता है, जो एक प्रशिक्षण-समय रक्षा (training-time defense) है जो संचयी एंट्रॉपी (cumulative entropy) और नमूना अनलर्निंग (sample unlearning) का लाभ उठाकर डेटा के एक सौम्य उपसमुच्चय (benign subset) का निर्माण करता है ताकि प्राकृतिक मॉडल सटीकता को बनाए रखते हुए बैकडोर नमूनों को प्रभावी ढंग से अलग और हटाया जा सके।

Qi Zhao, Christian Wressnegger2026-07-29
💻 computer science

SkillGate: Cost Efficient Runtime Malicious Skill File Detection in Coding Agents

SkillGate एक लागत-कुशल सुरक्षा गेटवे है जो उच्च पहचान सटीकता प्राप्त करने के साथ-साथ स्क्रीनिंग लागत और रनटाइम ओवरहेड को काफी कम करने के लिए एक हाइब्रिड रेगेक्स-प्रीफिल्टर और एलएलएम-जज पाइपलाइन का उपयोग करके एआई कोडिंग एजेंटों को दुर्भावनापूर्ण स्किल फ़ाइल सप्लाई-चेन हमलों से सुरक्षित करता है।

Rui Yang, Michael Fu, Kla Tantithamthavorn, Chetan Arora, Joey Chua2026-07-29