💻 computer science

ClawKeeper: Comprehensive Safety Protection for OpenClaw Agents Through Skills, Plugins, and Watchers

تقدم هذه الورقة ClawKeeper، وهو إطار عمل أمني شامل في الوقت الفعلي لوكلاء OpenClaw المستقلين، يعمل على التخفيف من الثغرات الأمنية الحرجة من خلال بنية ثلاثية الطبقات تتكون من سياسات تعليمات قائمة على المهارات، وإنفاذ وقت التشغيل القائم على الملحقات، ووسيط Watcher مبتكر ومنفصل للتدخل على مستوى النظام.

Songyang Liu, Chaozhuo Li, Chenxu Wang, Jinyu Hou, Zejian Chen, Litian Zhang, Zheng Liu, Qiwei Ye, Yiming Hei, Xi Zhang (…)2026-03-26
🤖 machine learning

Claudini: Autoresearch Discovers State-of-the-Art Adversarial Attack Algorithms for LLMs

تُثبت هذه الورقة أن مسار بحث تلقائي مدعوم بـ Claude Code يمكنه اكتشاف خوارزميات هجوم عدائية جديدة من نوع "الصندوق الأبيض" (white-box) بشكل مستقل، تتفوق بشكل كبير على الأساليب الحالية، محققة معدلات نجاح في الهجوم تصل إلى 100% ضد أحدث ضمانات حماية النماذج اللغوية الكبيرة (LLM).

Alexander Panfilov, Peter Romov, Igor Shilov, Yves-Alexandre de Montjoye, Jonas Geiping, Maksym Andriushchenko2026-03-26
💬 NLP

Analysing the Safety Pitfalls of Steering Vectors

تُثبت هذه الورقة بشكل منهجي أن نواقل توجيه التنشيط، ولا سيما تلك المستمدة من إضافة التنشيط التبايني، يمكن أن تغير بشكل جذري من قابلية النموذج اللغوي لهجمات كسر الحماية (jailbreak) من خلال تداخلها مع اتجاهات الرفض الكامنة، مما يكشف عن مقايضة حرجة بين القدرة على التحكم والسلامة.

Yuxiao Li, Alina Fastowski, Efstratios Zaradoukas, Bardh Prenkaj, Gjergji Kasneci2026-03-26
💻 computer science

Compact and Selective Disclosure for Verifiable Credentials

تقدم هذه الورقة البحثية CSD-JWT، وهي آلية مفتوحة المصدر تستفيد من المجمعات التشفيرية لتمكين الإفصاح الانتقائي والموجز عن أوراق الاعتماد القابلة للتحقق، مما يقلل بشكل كبير من استهلاك الذاكرة وعبء الشبكة للأجهزة ذات الموارد المحدودة ضمن أنظمة الهوية ذات السيادة الذاتية.

Alessandro Buldini, Carlo Mazzocca, Rebecca Montanari, Selcuk Uluagac2026-03-25
💬 NLP

Injecting Falsehoods: Adversarial Man-in-the-Middle Attacks Undermining Factual Recall in LLMs

تقدم هذه الورقة البحثية إطار عمل هجومي جديد يُدعى Xmera، يوضح أن هجمات حقن الأوامر التافهة يمكن أن تقوض بشدة قدرة النماذج اللغوية الكبيرة على استرجاع الحقائق بمعدلات نجاح عالية، مع اقتراح دفاع يعتمد على الغابة العشوائية (Random Forest) يميز بفعالية بين الاستجابات المخترقة والاستجابات المشروعة باستخدام عدم اليقين في التوليد.

Alina Fastowski, Bardh Prenkaj, Yuxiao Li, Gjergji Kasneci2026-03-25
🤖 machine learning

DP-FedSOFIM: Differentially Private Federated Stochastic Optimization using Regularized Fisher Information Matrix

تقترح الورقة البحثية DP-FedSOFIM، وهي طريقة تعلم اتحادي ذو خصوصية تفاضلية قابلة للتوسع تعمل على تسريع التقارب في ظل ميزانيات خصوصية صارمة من خلال الاستفادة من تحديثات من الرتبة الأولى من جانب الخادم لمصفوفة معلومات فيشر منظمة مشتقة من التدرجات المخصخصة، مما يتجنب التكاليف الحسابية وتكاليف الذاكرة لتقدير مصفوفة هسيان أو مصفوفة تغاير الميزات دون تكبد أي عبء إضافي على الخصوصية.

Sidhant Nair, Tanmay Sen, Mrinmay Sen, Sayantan Banerjee2026-03-25
💻 computer science

Architecture-Derived CBOMs for Cryptographic Migration: A Security-Aware Architecture Tradeoff Method

تقدم هذه الورقة SATAM، وهي طريقة لموازنة المقايضات المعمارية الواعية أمنياً تدمج أطر عمل راسخة مثل ATAM وSTRIDE لاستخلاص قوائم مواد تشفير (CBOMs) غنية بالسياق ومرتكزة على البنية المعمارية، مما يعزز التخطيط لترحيل التشفير من خلال التقاط القصد والتعليل الأمني الجوهري المفقود في النهج التقليدية القائمة على الجرد.

Eduard Hirsch, Kristina Raab2026-03-25
💻 computer science

Model Context Protocol Threat Modeling and Analyzing Vulnerabilities to Prompt Injection with Tool Poisoning

تحدد هذه الورقة تسميم الأدوات (tool poisoning) كثغرة أمنية حرجة في جانب العميل ضمن بروتوكول سياق النموذج (MCP)، وتثبت عدم كفاية الدفاعات الحالية لدى العملاء من خلال التحليل التجريبي، وتقترح استراتيجية دفاع متعددة الطبقات لتأمين أنظمة الوكلاء الاصطناعيين ضد هجمات حقن الأوامر البرمجية (prompt injection) من هذا النوع.

Charoes Huang, Xin Huang, Ngoc Phu Tran, Amin Milani Fard2026-03-25
💻 computer science

OrgForge-IT: A Verifiable Synthetic Benchmark for LLM-Based Insider Threat Detection

تقدم هذه الورقة OrgForge-IT، وهو معيار مرجعي اصطناعي قابل للتحقق يستخدم محرك محاكاة حتمي لضمان الاتساق عبر الأدوات في كشف التهديدات الداخلية، مما يكشف عن رؤى نقدية حول أداء النماذج، والتعامل مع الضجيج، وضرورة وجود مسارات فرز متخصصة من خلال تقييم شامل لعشرة نماذج لغوية.

Jeffrey Flynt2026-03-25
💻 computer science

CTF as a Service: A reproducible and scalable infrastructure for cybersecurity training

تقدم هذه الورقة تصميم وتطوير وتقييم منصة "تحديات التقاط العلم (CTF) كخدمة" قابلة للتكرار والتوسع، مبنية على Proxmox وTerraform وAnsible وDocker Swarm لأتمتة نشر تحديات التدريب على الأمن السيبراني والتغلب على الحواجز البنيوية التي تحد عادةً من اعتمادها في الأوساط الأكاديمية.

Carlos Jimeno Miguel amd Mikel Izal Azcarate2026-03-25