💻 computer science

SAMD: A Tool for Identifying False Data Injection Scenarios in AI/ML-enabled Medical Devices

تقدم الورقة البحثية SAMD، وهي أداة مؤتمتة تسخر النماذج اللغوية الكبيرة وقواعد بيانات الثغرات الأمنية لإجراء تحليل STPA-Sec على الأجهزة الطبية المدعومة بالذكاء الاصطناği وتعلم الآلة خلال مرحلة التصميم، مما يحدد بفعالية مخاطر حقن البيانات الزائفة ويولد سيناريوهات هجوم ذات صلة بدقة وإحكام عاليين.

Mohammadreza Hallajiyan, Xueren Ge, Athish Pranav Dharmalingam, Gargi Mitra, Shahrear Iqbal, Homa Alemzadeh, Karthik Pat (…)2026-05-29
💻 computer science

Relevance as a Vulnerability: How Web Retrieval Degrades Safety Alignment in LLM Agents

تقدم هذه الورقة إطار عمل AgentREVEAL وHarmURLBench لتوضيح أن الاسترجاع الويب في وكلاء النماذج اللغوية الكبيرة (LLM agents) يؤدي إلى تدهور المحاذاة الأمنية من خلال تضخيم الامتثال الضار عبر كل من التكامل أحادي الخطوة و"مفارقة المصدر الآمن" (Safe Source Paradox)، مما يكشف عن مقايضة أساسية بين السلامة والمنفعة حيث تعمل ذات الصلة التي تجعل الاسترجاع مفيداً كعامل ضعف في الوقت نفسه.

Aditya Nawal, Manit Baser, Mohan Gurusamy2026-05-29
💻 computer science

Evolving Skill-Structured Attack Memory Enhances LLM Jailbreaking

يقدم البحث MemoAttack، وهو إطار عمل لكسر الحماية (jailbreak) بنظام الصندوق الأسود مدفوع بالذاكرة، يستخدم نمذجة ذاكرة مهيكلة المهارات، وتطوراً مدفوعاً بدورة الحياة، واختياراً متوازناً بين الاستكشاف والاستغلال لتحقيق معدل نجاح هجوم بنسبة 98% على AdvBench مع التفوق بشكل كبير على النماذج المرجعية الحالية في الكفاءة والقدرة على التكيف.

Junke Zhang, Jianwei Wang, Sishuo Chen, Yizhang He, Qingshuai Feng, Zhengyi Yang2026-05-29
💻 computer science

Implicit Identity Technologies for LLMs: Fingerprinting and Watermarking across Datasets, Models, and Generated Content

تقدم هذه الورقة مفهوم "الهوية الضمنية" لتوحيد واستعراض تقنيات بصمة وتوسيم النماذج اللغوية الكبيرة، مقترحةً تصنيفاً شاملاً قائماً على دورة الحياة وإطار تقييم لمعالجة الحالة المجزأة لحماية الأصول والتحقق من المصدر عبر مجموعات البيانات والنماذج والمحتوى المُنشأ.

Bing Liu, Shunping Wang, Yufan Zhu, Xinyi Yu, Jing Huang, Linkang Du, Hongbin Pei, Wei Luo2026-05-29
🤖 AI

Provably Secure Agent Guardrail

تقترح هذه الورقة نموذجاً أمنياً جديداً لوكلاء الذكاء الاصطناعي يسمى إطار العمل "الإجراء المقيد بالبرهان القابل للتنفيذ" (ePCA)، والذي يستخدم بنية عزل عصبية رمزية لإجبار الوكلاء على صياغة نواياهم في شكل قيود منطقية من الدرجة الأولى قبل التنفيذ، مما يحقق دفاعاً حتمياً وآمناً بشكل مثبت ضد الهجمات الدلالية مع معدلات صفرية لنجاح الهجوم والإنذارات الكاذبة.

Benlong Wu, Weiming Zhang, Kejiang Chen, Han Fang, Nenghai Yu2026-05-29
🤖 AI

AliMark: Enhancing Robustness of Sentence-Level Watermarking Against Text Paraphrasing

يُعد ™AliMark إطار عمل قوي للعلامات المائية على مستوى الجملة، حيث يعيد صياغة عملية الكشف كمسألة محاذاة لتسلسل البتات، ويستخدم استراتيجية مرحلية من مرحلتين مع متغيرات نصية مُعاد هيكلتها بشكل تكيفي لمقاومة الاضطرابات الهيكلية مثل تقسيم الجمل ودمجها بفعالية.

Yuexin Li, Wenjie Qu, Linyu Wu, Yulin Chen, Yufei He, Tri Cao, Bryan Hooi, Jiaheng Zhang2026-05-29
💻 computer science

Protecting On-Device AI Inference: A Systematic Review of Attacks and Defence Mechanisms

تقدم هذه الورقة أول مراجعة منهجية شاملة للتهديدات وآليات الدفاع التي تستهدف تحديداً الاستدلال الخاص بالذكاء الاصطناعي على الأجهزة، كاشفةً عن خلل حرج حيث تفتقر الهجمات العدائية إلى استراتيجيات التخفيف المقابلة لها رغم تشكيلها جزءاً كبيراً من أدبيات الهجوم.

Zisis Tsiatsikas, Alexandros Fakis, Georgios Karopoulos, Vasileios Kouliaridis, Marios Anagnostopoulos2026-05-29
💻 computer science

Bridging Theory and Practice: An Executable Taxonomy of Security Properties for ProVerif and Tamarin

تقدم هذه الورقة تصنيفاً منهجياً قائماً على الأدلة لخصائص الأمان مستمداً من 53 دراسة حديثة، حيث توفر تعريفات غير رسمية ورسمية إلى جانب نماذج قابلة للتنفيذ باستخدام ProVerif وTamarin لسد الفجوة بين المفاهيم الأمنية النظرية والتحقق العملي لمصممي البروتوكولات.

Leonard Tudorache, Ivan Kurtev, Mark van den Brand2026-05-29
🤖 AI

SciIntBench: Measuring LLM Compliance with Research Integrity Norms Under Adversarial Framing

تقدم الورقة البحثية SciIntBench، وهو معيار تنافسي لتقييم 16 نموذجاً من النماذج اللغوية الكبيرة عبر 810 مطالبات ضمن عشر فئات من نزاهة البحث العلمي، كاشفةً أنه في حين ترفض النماذج بسلاسة سوء السلوك الصريح، إلا أنها تخفق بشكل متكرر في الالتزام بمعايير السلوك المسؤول عندما يتم تأطير الانتهاكات بشكل مستتر كاختصارات مدفوعة بالضغط.

Almene De Meran Meguimtsop, Maria Leonor Pacheco, Daniel E. Acuna2026-05-29
💻 computer science

CODEFUSE-DEBENCH: An Empirical Study on Readability, Recompilability, and Functionality

تقدم هذه الورقة DEBENCH، وهو إطار عمل مؤتمت جديد يقيم أدوات إلغاء التجميع الثنائي عبر ثلاثة أبعاد متعامدة — القابلية للقراءة، والقابلية لإعادة التجميع، والوظيفية — كاشفاً أن الأدوات الحالية تعاني من "منحدر إعادة استخدام" حاد حيث لا تضمن القابلية العالية للقراءة الصحة الوظيفية، وأن التقدم يعتمد على تحسين محركات إلغاء التجميع أكثر من اعتماده على نماذج إصلاح أكبر.

Puzhuo Liu, Yuhan Huang, Jianlei Chi, Peng Di, Yu Jiang2026-05-29