💻 computer science

Verifiable and Confidential DNN Inference on Low-End Edge Devices

यह शोध पत्र VECODI प्रस्तुत करता है, जो एक फ्रेमवर्क है जो SHANGRI-LA को पेश करके कम-स्तरीय एज डिवाइसेस पर सत्यापन योग्य और गोपनीय DNN इन्फरेंस को सक्षम बनाता है, जो कि TrustZone-M TEEs पर एक नवीन निष्पादन एब्स्ट्रैक्शन है जो मॉडल अखंडता की रक्षा करते हुए विश्वसनीय कंप्यूटिंग बेस और ओवरहेड को न्यूनतम करता है।

Mohamed Khalil Kiri (EURECOM), Ivan De Oliveira Nunes (University of Zurich), Aurélien Francillon (EURECOM), Norrathep R (…)2026-06-08
💻 computer science

Topology-Aware Differential Privacy in Federated Learning

यह शोध पत्र TADI प्रस्तुत करता है, जो फेडरेटेड लर्निंग में टोपोलॉजी-आधारित सूचना रिसाव (information leakage) का विश्लेषण करने के लिए एक फ्रेमवर्क है, और Fulcrum को व्युत्पन्न करता है, जो एक क्लोज्ड-फॉर्म नॉइज़ एलोकेशन मैकेनिज्म है जो मॉडल उपयोगिता से समझौता किए बिना एसिमेट्रिक क्रॉस-साइलो फेडरेशन में मानक DP-SGD की तुलना में गोपनीयता में सख्ती से सुधार करता है।

Murtaza Rangwala, Richard O. Sinnott, Rajkumar Buyya2026-06-05
💬 NLP

Correcting Prompt Dependence in LLM Benchmarks: A Bayesian Hierarchical Model with Embedding-Space Clustering

यह शोध पत्र एलएलएम (LLM) बेंचमार्किंग में शास्त्रीय अनुमान और प्रॉम्प्ट निर्भरता की सीमाओं को संबोधित करने के लिए एम्बेडिंग-स्पेस क्लस्टरिंग के साथ एक सुधारात्मक बेयसियन पदानुक्रमित मॉडल प्रस्तावित करता है, जिससे अधिक मजबूत प्रदर्शन मेट्रिक्स प्राप्त होते हैं और सीमित-डेटा सेटिंग्स में त्रुटियों में महत्वपूर्ण कमी आती है।

Mary Llewellyn, Isobel Thornton, James Bishop, Annie Gray2026-06-05
🤖 AI

CTIConnect: A Benchmark for Retrieval-Augmented LLMs over Heterogeneous Cyber Threat Intelligence

यह शोध पत्र CTIConnect को प्रस्तुत करता है, जो एक व्यापक बेंचमार्क और मूल्यांकन हारनेस (harness) है जिसे नौ विषम साइबर थ्रेट इंटेलिजेंस कार्यों में रिट्रीवल-ऑगमेंटेड LLMs का व्यवस्थित रूप से आकलन करने के लिए डिज़ाइन किया गया है, जो यह प्रकट करता है कि प्रभावी प्रदर्शन के लिए जेनेरिक रिट्रीवल सुधारों के बजाय डोमेन-विशिष्ट संरचनात्मक हस्तक्षेपों की आवश्यकता होती है।

Yutong Cheng, Yang Liu, Changze Li, Dawn Song, Peng Gao2026-06-05
💻 computer science

Evolution of Log-Based Detection Rules in Public Repositories

यह शोध पत्र सार्वजनिक रिपॉजिटरी में लॉग-आधारित डिटेक्शन रूल के विकास का पहला अनुदैर्ध्य विश्लेषण प्रस्तुत करता है, जो यह प्रकट करता है कि नियमों में परिवर्तन मुख्य रूप से गैर-एकदिष्ट (non-monotonic) हैं और स्थिर रूपों की ओर निरंतर अभिसरण के बजाय कवरेज और फॉल्स पॉजिटिव्स के बीच चल रहे परिचालन संबंधी समझौतों को दर्शाते हैं।

Minjun Long, David Evans2026-06-05
💻 computer science

Domain-Conditioned Safety in Frontier Computer-Using Agents: A 793-Episode Browser Benchmark, a Coding-Domain Cross-Reference, and a Reproducibility Audit of Recent Red-Teaming

यह शोध पत्र CUA-HandCrafted बेंचमार्क प्रस्तुत करता है ताकि यह प्रदर्शित किया जा सके कि जबकि फ्रंटियर कंप्यूटर-उपयोग करने वाले एजेंट ब्राउज़र वातावरण में हस्तनिर्मित प्रॉम्प्ट-इंजेक्शन हमलों के प्रति मजबूत प्रतिरोध प्रदर्शित करते हैं, उनकी सुरक्षा डोमेन-आधारित है और कोडिंग कार्यों तक सामान्यीकृत होने में विफल रहती है, जो यह सुझाव देता है कि पूर्व में रिपोर्ट की गई उच्च हमला सफलता दरें काफी हद तक RL-अनुकूलित इंजेक्शन स्ट्रिंग्स द्वारा संचालित थीं न कि अंतर्निहित मॉडल कमजोरियों द्वारा।

Nicholas Saban2026-06-05
💻 computer science

Search-Time Contamination in Deep Research Agents: Measuring Performance Inflation in Public Benchmark Evaluation

यह शोध पत्र "सर्च-टाइम कंटैमिनेशन" (Search-Time Contamination) की पहचान और मात्रा निर्धारण करता है, जो एक ऐसी घटना है जहाँ डीप रिसर्च एजेंट इन्फरेंस के दौरान वेब सर्च के माध्यम से बेंचमार्क उत्तर या संदर्भ प्राप्त कर लेते हैं, जिससे प्रदर्शन मेट्रिक्स कृत्रिम रूप से बढ़ जाते हैं और यह आइसोलेटेड सैंडबॉक्स जैसे कंटैमिनेशन-अवेयर मूल्यांकन अभ्यासों को अपनाने का आग्रह करता है।

Yongjie Wang, Xinyue Zhang, Kunhong Yao, Zhiwei Zeng, Kaisong Song, Jun Lin, Zhiqi Shen2026-06-05
💻 computer science

Willing but Unable: Separating Refusal from Capability in Code LLMs via Abliteration

यह शोध पत्र प्रदर्शित करता है कि "एब्लिटरेशन" (abliteration), जो कि रिफ्यूज़ल दिशाओं को ऑर्थोगोनली प्रोजेक्ट करने वाली एक लो-रैंक वेट एडिटिंग तकनीक है, सुरक्षा-संरेखित कोड एलएलएम (LLM) की असुरक्षित कोड उत्पन्न करने से मना करने की प्रवृत्ति को उनकी वास्तविक पीढ़ी क्षमताओं से प्रभावी रूप से अलग कर सकता है, जिससे सिंटैक्टिक वैधता से समझौता किए बिना भेद्यता पहचान अनुसंधान के लिए लेबल किए गए असुरक्षित कोड का स्केलेबल उत्पादन सक्षम हो जाता है।

Cristina Carleo, Pietro Liguori, Naghmeh Ivaki, Domenico Cotroneo2026-06-05
💻 computer science

Policy-Compliant Cloud Storage Systems

यह शोध पत्र GDPRuler प्रस्तुत करता है, जो एक विश्वसनीय मिडलवेयर सिस्टम है जो एक कॉन्फिडेंशियल वर्चुअल मशीन के भीतर एक नीति-प्रवर्तन मॉनिटर (policy-enforcing monitor) को तैनात करके अविश्वसनीय क्लाउड्स पर बिना किसी संशोधन वाले की-वैल्यू स्टोर्स के लिए सत्यापन योग्य GDPR अनुपालन सक्षम बनाता है, जिससे कम प्रदर्शन ओवरहेड और कुशल मेटाडेटा प्रबंधन के साथ मजबूत अनुपालन गारंटी प्राप्त होती है।

Dimitrios Stavrakakis, Masanori Misono, Julian Pritzi, Harshavardhan Unnibhavi, Nuno Santos, Pramod Bhatotia2026-06-05
💻 computer science

DP-MacAdam: Differentially Private Mechanism with Adaptive Clipping and Adaptive Momentum

यह शोध पत्र DP-MacAdam का प्रस्ताव करता है, जो एक नवीन डिफरेंशियल प्राइवेट ऑप्टिमाइज़ेशन एल्गोरिदम है जो साझा अनुभवजन्य माध्य (empirical mean) और विचरण (variance) अनुमानों का लाभ उठाकर एडेप्टिव ग्रेडिएंट क्लिपिंग और मोमेंटम अपडेट को एकीकृत करता है, जिससे मैनुअल क्लिपिंग थ्रेशोल्ड ट्यूनिंग के बिना बेहतर मॉडल उपयोगिता प्राप्त होती है।

Naima Tasnim, Lalitha Sankar, Oliver Kosut2026-06-05