💻 computer science

Tracing the Dynamics of Refusal: Exploiting Latent Refusal Trajectories for Robust Jailbreak Detection

تقترح هذه الورقة SALO، وهو كاشف عند وقت الاستدلال يستفيد من التتبع السببي لتحديد "مسارات الرفض" المستمرة والمتفرقة في التمثيلات الكامنة، مما يحقق كشفاً قوياً لعمليات كسر الحماية (بمعدل نجاح يتجاوز 90%) ضد الهجمات التي تنجح في كبح إشارات الرفض النهائية.

Xulin Hu, Che Wang, Wei Yang Bryan Lim, Jianbo Gao, Zhong Chen2026-05-06
💻 computer science

Observability for Post-Quantum TLS Readiness: A Multi-Surface Evidence Framework

تقدم هذه الورقة إطاراً للأدلة متعدد الأسطح لقابلية الملاحظة في جاهزية بروتوكول (TLS) لما بعد الكوانتوم، والذي يدمج القياسات السلبية والنشطة والقائمة على السجلات للتمييز بدقة بين سلوكيات الجلسات وقدرات النقاط الطرفية، مما يظهر تفوقاً كبيراً في اكتشاف تأسيس المفاتيح الهجين وثغرات الكوانتوم مقارنة بالمحللات المرجعية الحالية.

José Luis Delgado2026-05-06
💻 computer science

Towards a Risk-Cost Model for Financial Adaptive Authentication

تقدم هذه الورقة نموذج مخاطر-تكلفة (RCM) رسميًا للمصادقة التكيفية المالية، والذي يعيد صياغة العملية كمسألة تحسين ديناميكية مقيدة، تدمج دوال المخاطر الحساسة للتكلفة، واتخاذ القرار المتسلسل، وقيود الخصوصية لإنشاء أنظمة ذات أسس اقتصادية وصامدة ضد عدم اليقين العدائي.

Supriya Khadka, Sanchari Das2026-05-06
💻 computer science

PHANTOM: Polymorphic Honeytoken Adaptation with Narrative-Tailored Organisational Mimicry

تقدم الورقة البحثية إطار عمل PHANTOM، الذي يعزز بشكل كبير من مقاومة اكتشاف "عسل التمويه" (honeytoken) والقدرة على التصديق البشري من خلال توليد طعوم متعددة الأشكال ومخصصة للمؤسسات عبر محاكاة مصممة سردياً، متفوقاً بذلك على النهج القائم على القوالب الثابتة عبر مقاييس إحصائية وتقييمات بشرية متعددة.

Abraham Itzhak Weinberg2026-05-06
💻 computer science

Distributed Deep Variational Approach for Privacy-preserving Data Release

تقترح هذه الورقة "حامي الخصوصية الغاوسي" (GPP)، وهو إطار عمل تبايني عميق وموزع يُمكّن التعلم الاتحادي من إصدار تمثيلات بيانات مطهرة ومنخفضة الأبعاد تحافظ بفعالية على المنفعة مع تقليل تسرب السمات الحساسة من خلال تقليل المعلومات المتبادلة.

Zahir Alsulaimawi, Huaping Liu2026-05-06
💻 computer science

Revisiting JBShield: Breaking and Rebuilding Representation-Level Jailbreak Defenses

تُثبت هذه الورقة أن دفاع JBShield ضد كسر الحماية (jailbreak) عرضة لهجوم تكيفي جديد (JB-GCG) عبر استغلال العيوب الهيكلية في الكشف القائم على المفاهيم، وتقترح دفاعاً أكثر متانة يعتمد على التحقق من مسار التمثيل متعدد الطبقات (RTV) والذي يحقق كشفاً يقارب المثالية ضد هذا الهجوم الجديد والهجمات التكيفية اللاحقة.

Kemal Derya, Berk Sunar2026-05-06
💻 computer science

PIIGuard: Mitigating PII Harvesting under Adversarial Sanitization

تُعد PIIGuard آلية دفاع على مستوى صفحات الويب تستخدم قطعاً برمجية مخفية ومُحسّنة من لغة HTML لتوجيه النماذج اللغوية الكبيرة بعيداً عن الكشف عن معلومات الهوية الشخصية (PII) الخاصة ببيانات الاتصال، مما يحقق معدلات نجاح عالية في منع تسرب البيانات مع الحفاظ على الفائدة للاستعلامات الحميدة.

Mingshuo Liu, Yiwei Zha, Min Chen2026-05-06
💻 computer science

Evaluating Retrieval-Augmented Generation for Explainable Malware Analysis

تثبت هذه الورقة تجريبياً أن التوليد المعزز بالاسترجاع (RAG) غالباً ما يؤدي إلى تدهور جودة تفسيرات البرمجيات الخبيثة من خلال إدخال ضجيج وسياق غير ذي صلة، مما يشير إلى أن تحليل البرمجيات الخبيثة يُعامل بشكل أفضل كمهمة استخراج إشارات بدلاً من كونها مشكلة استرجاع معرفة عندما تكون الأدلة المهيكلة متاحة بالفعل.

Jayson Ng, Amin Milani Fard2026-05-06
💻 computer science

HackerSignal: A Large-Scale Multi-Source Dataset Linking Hacker Community Discourse to the CVE Vulnerability Lifecycle

تقدم هذه الورقة HackerSignal، وهو عبارة عن مجموعة بيانات ضخمة متعددة المصادر تجمع 7.45 مليون وثيقة من عام 1990 إلى عام 2026 لربط خطاب مجتمع الهكرز بدورة حياة ثغرات CVE الكاملة، لتكون بمثابة معيار لاستخبارات التهديدات السيبرانية خارج التوزيع الزمني ومهام ربط CVE عبر المصادر المختلفة.

Benjamin M. Ampel, Sagar Samtani2026-05-06
💻 computer science

A Validated Prompt Bank for Malicious Code Generation: Separating Executable Weapons from Security Knowledge in 1,554 Consensus-Labeled Prompts

تقدم هذه الورقة بنك "CODE" المكون من 1,554 مطالبة (prompt) والمُتحقق من صحتها، وإطار عمل للتصنيف القائم على الإجماع يفصل بصرامة بين طلبات البرمجيات الخبيثة القابلة للتنفيذ واستعلامات المعرفة الأمنية الضارة لمعالجة مشكلات الخلط في معايير سلامة النماذج اللغوية الحالية.

Richard J. Young, Gregory D. Moody2026-05-06