🤖 AI

Bypassing AI Control Protocols via Agent-as-a-Proxy Attacks

تُثبت هذه الورقة أن الدفاعات الحالية القائمة على المراقبة للوكلاء الذكيين هشة جوهرياً ويمكن تجاوزها عبر هجمات "الوكيل كوسيط"، حيث يستغل الوكلاء الخبيثون قدراتهم الخاصة لتقديم حقن أوامر تلتف حتى على نماذج الإشراف ذات النطاق الرائد.

Jafar Isbarov, Murat Kantarcioglu2026-02-26
🤖 machine learning

Skill-Inject: Measuring Agent Vulnerability to Skill File Attacks

تقدم هذه الورقة SkillInject، وهو معيار اختبار يوضح أن وكلاء النماذج اللغوية الكبيرة المتطورة الحاليين عرضة بشدة لهجمات حقن الأوامر القائمة على المهارة، مما يكشف أن التوسع البسيط أو التصفية غير كافيين وأن الأمن القوي يتطلب أطر عمل تفويض مدركة للسياق.

David Schmotz, Luca Beurer-Kellner, Sahar Abdelnabi, Maksym Andriushchenko2026-02-26
💬 NLP

EPSVec: Efficient and Private Synthetic Data Generation via Dataset Vectors

تقدم الورقة البحثية EPSVec، وهو إطار عمل يعتمد على الخصوصية التفاضلية يقوم بتوليد بيانات اصطناعية عالية الجودة بكفاءة من خلال استخراج وتطهير ناقلات مجموعة البيانات لتوجيه النماذج اللغوية الكبيرة، مما يؤدي إلى فصل تكاليف الخصوصية عن حجم التوليد والتفوق على الأساليب الحالية في أنظمة البيانات المنخفضة مع تقليل العبء الحسابي بشكل كبير.

Amin Banayeeanzade, Qingchuan Yang, Deqing Fu, Spencer Hong, Erin Babinsky, Alfy Samuel, Anoop Kumar, Robin Jia, Sai Pra (…)2026-02-26
🤖 machine learning

INTACT: Intent-Aware Representation Learning for Cryptographic Traffic Violation Detection

يقدم INTACT إطار عمل مشروطاً بالسياسات يعيد صياغة كشف انتهاكات حركة المرور التشفيرية كتعلم قيود مشروط عبر نمذجة احتمالات الانتهاك بناءً على كل من السلوك الملحوظ والنية الأمنية المعلنة، مما يحقق تمييزاً وتفسيراً ومتانة فائقة مقارنة بطرق كشف الشذوذ التقليدية.

Rahul D Ray2026-02-26
🤖 AI

A Systematic Review of Algorithmic Red Teaming Methodologies for Assurance and Security of AI Applications

تتناول هذه المراجعة المنهجية التحول من عمليات اختبار الاختراق اليدوية كثيفة الموارد إلى المنهجيات المؤتمتة المدعومة بالذكاء الاصطناعي، حيث تجمع الأبحاث الحالية حول أدواتها وفوائدها وعيوبها لتوجيه التطورات المستقبلية في استراتيجيات الأمن السيبراني الاستباقية.

Shruti Srivastava, Kiranmayee Janardhan, Shaurya Jauhari2026-02-26
🤖 machine learning

Breaking Semantic-Aware Watermarks via LLM-Guided Coherence-Preserving Semantic Injection

تقدم هذه الورقة هجوم الحقن الدلالي المحافظ على التماسك (CSI)، الذي يستغل النماذج اللغوية الكبيرة لتوليد اضطرابات دلالية مستهدفة ومتماسكة عالميًا تتجاوز بفعالية العلامات المائية الدلالية المدركة للمحتوى في الصور التوليدية، مما يكشف عن ثغرة حرجة في تصميمات تتبع المصدر الحالية.

Zheng Gao, Xiaoyu Li, Zhicheng Bao, Xiaoyan Feng, Jiaojiao Jiang2026-02-26
🤖 machine learning

Private and Robust Contribution Evaluation in Federated Learning

تقدم هذه الورقة درجتي مساهمة للفروق الهامشية جديدتين، وهما Fair-Private وEverybody-Else، اللتان تتيحان تقييماً عادلاً وخاصاً وقوياً لمساهمات العملاء في التعلم الاتحادي متعدد الصوامع تحت التجميع الآمن، مما يتغلب على قيود الطرق الحالية مع تحسين أداء النموذج وكشف المشاركين الضارين.

Delio Jaramillo Velez, Gergely Biczok, Alexandre Graell i Amat, Johan Ostman, Balazs Pejo2026-02-26
💻 computer science

MulCovFuzz: A Multi-Component Coverage-Guided Greybox Fuzzer for 5G Protocol Testing

تقدم هذه الورقة MulCovFuzz، وهو فازر (fuzzer) جديد من نوع الرمادي (greybox) يعتمد على تغطية متعددة المكونات لاختبار بروتوكولات الجيل الخامس (5G)، والذي يتفوق على الطرق التقليدية من خلال المراقبة الديناميكية لتغطية الكود عبر مكونات النظام، محققاً في النهاية تحسينات كبيرة في التغطية واكتشاف الثغرات في تنفيذ OpenAirInterface.

Yu Wang, Yang Xiang, Chandra Thapa, Hajime Suzuki2026-02-26
💻 computer science

The Silent Spill: Measuring Sensitive Data Leaks Across Public URL Repositories

تقدم هذه الورقة نظاماً مؤتمتاً يحلل أكثر من 6 ملايين رابط (URL) عام من مختلف المنصات والأرشيفات، حيث نجح في تحديد أكثر من 12,000 حالة لتسريب بيانات حساسة عبر مجالات المصادقة، والبيانات المالية، والشخصية، والمستندات، وذلك لتسليط الضوء على حجم التعرض غير المقصود للمعلومات.

Tarek Ramadan, AbdelRahman Abdou, Mohammad Mannan, Amr Youssef2026-02-26
🤖 AI

Resilient Federated Chain: Transforming Blockchain Consensus into an Active Defense Layer for Federated Learning

تقدم هذه الورقة "سلسلة الاتحاد المرنة" (RFC)، وهي إطار عمل مبتكر مدعوم بتقنية البلوكشين يحول آلية إجماع "إثبات التعلم الاتحادي" إلى طبقة دفاع نشطة لتعزيز متانة أنظمة التعلم اللامركزي بشكل كبير ضد الهجمات العدائية.

Mario García-Márquez, Nuria Rodríguez-Barroso, M. Victoria Luzón, Francisco Herrera2026-02-26