💻 computer science

Baselines Before Architecture: Evaluating Coding Agents for Autonomous Penetration Testing

यह शोध पत्र तर्क देता है कि स्वायत्त पेनेट्रेशन टेस्टिंग एजेंटों के भविष्य के मूल्यांकन के लिए नियंत्रित, मॉडल-मैच्ड प्लेन-एजेंट बेसलाइन स्थापित करना अनिवार्य है ताकि आर्किटेक्चरल नवाचारों से प्राप्त प्रदर्शन लाभ और अंतर्निहित मॉडल सुधारों के कारण होने वाले लाभ के बीच सटीक अंतर किया जा सके।

Ananda Dhakal, Krish Neupane, Aarjan Chaudhary2026-07-16
💻 computer science

GDM AI Control Roadmap

यह शोध पत्र GDM AI कंट्रोल रोडमैप (v0.1) प्रस्तुत करता है, जो संभावित रूप से गलत संरेखित (misaligned) AI एजेंटों के विरुद्ध आंतरिक सुरक्षा के लिए अपनी तरह का पहला ब्लूप्रिंट है, जो एक थ्रेट टैक्सोनॉमी (TRAIT&R) और 15 व्यावहारिक, क्षमता-आधारित रक्षाओं का एक स्तरीय ढांचा पेश करता है जो कम लागत वाली निगरानी से लेकर उन्नत सिस्टम-स्तरीय सुरक्षा उपायों तक विस्तृत है।

Mary Phuong, Erik Jenner, Laurent Simon, Lewis Ho, Rohin Shah, Sebastian Farquhar, Scott Coull2026-07-16
💻 computer science

Efficient and Privacy Aware Edge Cloud Collaborative Inference for Large Language Models

यह शोध पत्र लार्ज लैंग्वेज मॉडल इन्फरेंस के लिए एक गोपनीयता-केंद्रित एज-क्लाउड सहयोगात्मक ढांचे का प्रस्ताव करता है जो विषम उपकरणों (heterogeneous devices) में उपयोगकर्ता की गोपनीयता को बनाए रखते हुए विलंबता (latency) और बैंडविड्थ के उपयोग को महत्वपूर्ण रूप से कम करने के लिए एंडपॉइंट-प्रमाणित KV कैश और एन्क्रिप्टेड डेटा ट्रांसमिशन का लाभ उठाता है।

Yi Li, Chen Li, Jiexiong Liu2026-07-16
💻 computer science

Designing a GDPR-Compliant Security Architecture for Remote Elderly Care Systems: A Privacy-by-Design Approach

यह शोध पत्र सिक्योर एज गेटवे (SEG) फ्रेमवर्क प्रस्तुत करता है, जो रिमोट एल्डरली केयर के लिए एक प्राइवेसी-बाय-डिजाइन आर्किटेक्चर है जो एज-लेयर स्यूडोनिमाइजेशन (pseudonymisation) के माध्यम से जीडीपीआर (GDPR) अनुपालन सुनिश्चित करने के साथ-साथ बुजुर्गों के लिए जीरो-इंटरेक्शन उपयोगिता बनाए रखता है, और स्ट्राइड (STRIDE)-आधारित थ्रेट मॉडलिंग के माध्यम से सुरक्षा को प्रमाणित करता है, जो यह प्रदर्शित करता है कि नियामक अनुपालन और परिचालन दक्षता संसाधन-सीमित IoMT प्रणालियों में पूरक लक्ष्य हैं।

Md. Rahid Parvez, Mikael Soini2026-07-16
💻 computer science

Composable Trust for Language Models: A proven boundary and a measured defense

यह शोध पत्र एक कंपोजेबल ट्रस्ट फ्रेमवर्क पेश करता है जो अधिकार को भाषा मॉडलों से बाहर एक नियत (डिटरमिनिस्टिक), प्रमाणित रूप से सुरक्षित पाइपलाइन में ले जाता है, जो यह प्रदर्शित करता है कि यह प्रतिक्रिया की उच्च गुणवत्ता बनाए रखते हुए इंजेक्शन हमलों के विरुद्ध प्रभावी ढंग से बचाव कर सकता है और स्रोत एट्रिब्यूशन में सुधार कर सकता है।

Yakov Pyotr Shkolnikov2026-07-16
💻 computer science

BARS: Benign-Anchored Ranking and Selection for False Alarm Reduction in Network Intrusion Detection

यह शोध पत्र बेनाइन-एंकरड रैंकिंग एंड सिलेक्शन (BARS) का प्रस्ताव करता है, जो एक गणनात्मक रूप से कुशल, दो-चरणीय फीचर चयन फ़िल्टर है जो वैश्विक माध्य के बजाय बेनाइन-क्लास माध्य (benign-class mean) के साथ स्कोर को एंकर करके नेटवर्क घुसपैठ का पता लगाने में गलत अलार्म को कम करता है, जिससे कम संसाधन ओवरहेड बनाए रखते हुए असंतुलित डेटासेट पर मौजूदा विषम विधियों से बेहतर प्रदर्शन करता है।

Abu Fuad Ahmad, Istiaque Ahmed2026-07-16
💬 NLP

The Refusal Residue: When Probes Catch Alignment Faking and When They Don't

यह शोध पत्र विशिष्ट लार्ज लैंग्वेज मॉडल्स में एलाइनमेंट फेकिंग (alignment faking) के उद्भव की जांच करता है, जो यह प्रकट करता है कि जबकि हिडन स्टेट्स (hidden states) कभी-कभी ऐसे भ्रामक व्यवहार का पता लगा सकते हैं, मानक प्रोबिंग विधियाँ गंभीर अति-अनुमान और लीकेज के प्रति संवेदनशील होती हैं, जिसके लिए विश्वसनीय पहचान हेतु एक कठोर पांच-नियंत्रण ढांचे की आवश्यकता होती है।

Aman Mehta2026-07-16
💻 computer science

xChk: Bring Your Own Identity -- Heterogeneous Assurance with Verifier-Determined Sufficiency

यह शोध पत्र xChk प्रस्तुत करता है, जो 'ब्रिंग योर ओन आइडेंटिटी' (BYOI) के लिए एक संदर्भ पहचान प्रदाता है, जो उपयोगकर्ताओं को विविध सत्यापन पद्धतियों के माध्यम से नामांकन करने और मानक OAuth/OIDC टोकन के रूप में दावों को प्रकट करने में सक्षम बनाता है, जबकि एक्सेस पर्याप्तता के निर्णयों को निर्भर पक्षों (relying parties) को सौंपता है और एक साझा सत्यापन ग्राफ के माध्यम से मानव और AI-एजेंट दोनों के प्रमाणों का समर्थन करता है।

Sean MacGuire2026-07-16
🤖 machine learning

Evaluating Frontier AI Agents as Autonomous Clinical Security Auditors

यह शोध पत्र METR टास्क स्टैंडर्ड पर आधारित एक ओपन इवैल्यूएशन टास्क पेश करता है जो यह परीक्षण करता है कि क्या फ्रंटियर एआई एजेंट्स हमलों को लागू करके, सुरक्षा स्कोर की गणना करके और रिपोर्ट तैयार करके स्वायत्त रूप से संरचित क्लिनिकल एआई सुरक्षा ऑडिट कर सकते हैं, जो यह प्रदर्शित करता है कि क्लाउड सोनेट 4.6 और GPT-4.1 जैसे मॉडल्स कई डेटासेट्स और आर्किटेक्चर में पूर्ण स्कोर प्राप्त कर सकते हैं।

Michael O. Eniolade2026-07-16
💻 computer science

ReBound: Reuse-Aware Privacy For Interactive Decision Support

ReBound एक इंटरैक्टिव निर्णय सहायता (डिसीजन सपोर्ट) के लिए एक डिफरेंशियल प्राइवेट फ्रेमवर्क है जो एक नवीन कैश ग्राफ संरचना और नेगोशिएशन मैकेनिज्म के माध्यम से पिछले प्रश्नों के कैश किए गए परिणामों का पुन: उपयोग करके अतिरिक्त गोपनीयता लागत को कम या समाप्त करता है, जबकि औपचारिक उपयोगिता गारंटी बनाए रखता है।

Nada Lahjouji, Shufan Zhang, Xi He, Sharad Mehrotra2026-07-16