💻 computer science

Secure Seed-Based Multi-bit Watermarking for Diffusion Models from First Principles

تقدم هذه الورقة إطاراً نظرياً مستقلاً عن النموذج لتقييم العلامات المائية القائمة على البذرة في نماذج الانتشار بناءً على الأمن والمتانة والدقة، وتقترح طريقة مبتكرة تسمى SSB تتيح التحكم الدقيق في هذه المقايضات دون الاعتماد على التقييمات التجريبية المكلفة.

Enoal Gesny, Eva Giboulot2026-05-08
💻 computer science

Stateful Agent Backdoor

تقدم هذه الورقة هجوماً بباب خلفي ذا حالة (stateful backdoor attack) على الوكلاء القائمين على النماذج اللغوية الكبيرة، والذي يتغلب على قيود الطرق الحالية عديمة الحالة (stateless methods) من خلال الحفاظ على حالة مستمرة عبر جلسات متعددة لتمكين التنفيذ الذاتي والتزايدي عقب محفز لمرة واحدة.

Zhengchunmin Dai, Jiaxiong Tang, Liantao Wu, Peng Sun, Honglong Chen2026-05-08
🤖 machine learning

Trade-off Functions for DP-SGD with Subsampling based on Random Shuffling: Tight Upper and Lower Bounds

تضع هذه الورقة حدوداً عليا وسفلى محكمة وشفافة ذات صيغة مغلقة لدالة المقايضة الخاصة بخوارزمية التدرج الاشتقاقي العشوائي ذي الخصوصية التفاضلية (DP-SGD) مع أخذ العينات بالخلط العشوائي، مما يثبت أن هذه الطريقة توفر قدرة فائقة على التفسير ومقايضات أفضل بين الخصوصية والمنفعة مقارنة بأخذ العينات بأسلوب "بواسون"، لا سيما في الحالات التي يكون فيها مضاعف الضجيج كبيراً بما يكفي.

Marten van Dijk, Murat Bilgehan Ertan2026-05-08
🤖 machine learning

Gaming the Metric, Not the Harm: Certifying Safety Audits against Strategic Platform Manipulation

تُثبت هذه الورقة أن مقاييس السلامة القياسية قابلة للتلاعب بطبيعتها من قِبل المنصات الاستراتيجية التي تسعى لتحسين الدرجات بدلاً من تقليل الضرر الفعلي، وتقترح طريقة اعتماد "الغلاف الدلالي" التي تظل صامدة أمام هذا التلاعب عبر تعيين أسوأ درجة ممكنة ضمن الفئة المتكافئة دلالياً لكل متغير محتوى.

Florian A. D. Burnat, Brittany I. Davidson2026-05-08
🤖 AI

Fine-Tuning Small Language Models for Solution-Oriented Windows Event Log Analysis

تُثبت هذه الورقة أن نماذج اللغات الصغيرة (SLMs) التي تم ضبطها بدقة يمكن أن تعمل كبديل محلي أكثر كفاءة وفعالية لنماذج اللغات الكبيرة لتحليل سجلات أحداث ويندوز (Windows event logs) من خلال تحديد المشكلات بدقة وتوليد خطوات معالجة قابلة للتنفيذ باستخدام مجموعة بيانات اصطناعية تم إنشاؤها حديثاً.

Siraaj Akhtar, Saad Khan, Simon Parkinson2026-05-08
💻 computer science

Pop Quiz Attack: Black-box Membership Inference Attacks Against Large Language Models

تقدم هذه الورقة البحثية "هجوم PopQuiz"، وهو أسلوب جديد لاستنتاج العضوية بنظام الصندوق الأسود يقوم بتحويل بيانات التدريب إلى اختبارات متعددة الخيارات لتحديد ما إذا كانت أمثلة محددة قد استُخدمت في تدريب النماذج اللغوية الكبيرة بفعالية، محققاً معدلات نجاح أعلى بكثير من الأساليب الحالية مع إثبات أن الدفاعات الحالية لا تخفف سوى جزء من مخاطر الخصوصية.

Zeyuan Chen, Yihan Ma, Xinyue Shen, Michael Backes, Yang Zhang2026-05-08
🤖 AI

MalPurifier: Enhancing Android Malware Detection with Adversarial Purification against Evasion Attacks

يُعد MalPurifier إطار عمل جديداً لتنقية البرمجيات الخبيثة، وهو خفيف الوزن ومستقل عن النموذج، يعمل على تعزيز كشف برمجيات أندرويد الخبيثة بشكل كبير من خلال دمج اضطرابات متنوعة، وإدخال ضوضاء وقائية، وتوظيف مشفر تلقائي لإزالة الضجيج ثنائي الأهداف للدفاع بقوة ضد طيف واسع من هجمات التهرب مع الحفاظ على دقة عالية.

Yuyang Zhou, Guang Cheng, Zongyao Chen, Shui Yu2026-05-07
🤖 machine learning

Aggressive or Imperceptible, or Both: Network Pruning Assisted Hybrid Byzantines in Federated Learning

تقدم هذه الورقة هجوماً بيزنطياً هجيناً متفرقاً للتعلم الاتحادي يجمع بين التلاعب بالمعلمات القائم على الحساسية والتسميم بطيء التراكم لتجاوز الدفاعات المتطورة بفعالية من خلال استغلال بنية الشبكة العصبية بدلاً من الاعتماد على الكشف عن القيم المتطرفة إحصائياً.

Emre Ozfatura, Kerem Ozfatura, Baturalp Buyukates, Mert Coskuner, Alptekin Kupcu, Deniz Gunduz2026-05-07
🤖 AI

Coward: Collision-based OOD Watermarking for Practical Proactive Federated Backdoor Detection

تقدم الورقة البحثية Coward، وهي طريقة استباقية جديدة للكشف عن الأبواب الخلفية في التعلم الاتحادي، والتي تستفيد من تأثيرات تصادم الأبواب الخلفية المتعددة لحقن علامة مائية مصممة بعناية، مما يتغلب بفعالية على القيود التي تفرضها التقنيات الحالية الناتجة عن توزيعات البيانات غير المتماثلة (non-i.i.d.) والانحيازات الناتجة عن البيانات الخارجة عن التوزيع (out-of-distribution).

Wenjie Li, Siying Gu, Yiming Li, Shuxin Li, Zhili Chen, Tianwei Zhang, Shu-Tao Xia2026-05-07
💻 computer science

AgenTEE: Confidential LLM Agent Execution on Edge Devices

إنّ AgenTEE هو نظام مبني على بنية الحوسبة السرية من Arm (CCA) يتيح التنفيذ الآمن والسري لوكلاء النماذج اللغوية الكبيرة على أجهزة الحافة عبر عزل بيئة التشغيل، ومحرك الاستدلال، والتطبيقات الخارجية داخل أجهزة افتراضية سرية موثقة بشكل مستقل، محققاً أداءً يقارب الأداء الأصلي مع عبء تشغيلي يقل عن 5.15%.

Sina Abdollahi, Mohammad M Maheri, Javad Forough, Amir Al Sadi, Josh Millar, David Kotz, Marios Kogias, Hamed Haddadi2026-05-07