💻 computer science

Can AI Write Compliant Code, and to What Extent? Evaluating SOC 2 Compliance of Claude Fable 5, Claude Opus 4.8, and Claude Opus 5 Across Four Use Cases

تقيم هذه الدراسة امتثال نماذج الذكاء الاصطناي الرائدة الثلاثة لمعايير SOC 2 عبر أربع حالات استخدام، حيث وجدت أنه بينما غالبًا ما يحتوي توليد الكود البرمجي غير الموجه بطلب مسبق على ثغرات أمنية حرجة ويفتقر إلى ضوابط أمنية رئيسية، فإن إضافة جملة واحدة تشير إلى معايير SOC 2 يحسن الامتثال بشكل ملحوظ ليصل إلى 86-100% ويقضي على البنى غير الآمنة، رغم فشله في معالجة الضوابط الخارجة عن نطاق تصور النموذج للمهمة المباشرة، كما يسلط الضال على عدم موثوقية التقييم القائم على مطابقة الأنماط الآلية لصالح التحقق الدلالي.

Iccha Sethi, Herman Errico2026-08-11
💻 computer science

The Anatomy of a Prompt Injection: A Component Model for Structured Analysis

تقترح هذه الورقة نموذجاً رسمياً مكوناً من سبعة عناصر لهيكلة تحليل هجمات حقن الأوامر (prompt injection)، مما ينقل التركيز من مطابقة النصوص الهشة إلى تتبع نية المهاجم وتمكين التصنيف والمقارنة والتحوير المعياري للتهديدات عبر مجالات أمن الذكاء الاصطناعي.

Jeremy McHugh2026-08-11
💻 computer science

Capability-Routed Guard: Defending Large Reasoning Models Against Reasoning-Centric Jailbreaks

تقدم هذه الورقة "حارس التوجيه القائم على القدرة" (CRG)، وهو إطار عمل محايد للنماذج يعمل أثناء مرحلة الاستدلال للدفاع عن نماذج الاستدلال الكبيرة ضد عمليات الاختراق المتمحورة حول الاستدلال، وذلك عبر إعادة صياغة أمن المطالبات كمسألة توجيه قدرات لفصل المهام المصرح بها عن سياقات الاستدلال غير الموثوقة، مما يؤدي بفعالية إلى تخفيف الهجمات مع الحفاظ على المنفعة الحميدة.

Yiyong Liu, Yixin Wu, Jun Sakuma2026-08-11
💻 computer science

Velosiraptor: Code Synthesis for Memory Translation

يعتبر Velosiraptor نظاماً لتوليد الأكواد البرمجية يقوم تلقائياً بتوليد أكواد أنظمة تشغيل منخفضة المستوى ومحققة لتهيئة أجهزة الذاكرة، مما يؤدي إلى القضاء على أخطاء التنفيذ اليدوي وتسهيل عملية نقل أنظمة التشغيل إلى منصات جديدة ذات آليات ترجمة مبتكرة.

Reto Achermann, Em Chu, Ryan Mehri, Ilias Karimalis, Margo Seltzer2026-08-11
💻 computer science

Algebraic Attack on Convolutional Neural Networks with Max Pooling

تقترح هذه الورقة أول هجوم تحليل تشفيري قادر على استخراج الأوزان والانحيازات من الشبكات العصبية الالتفافية ذات التجميع الأقصى (max pooling) عبر إثبات طبيعتها الجبرية الخطية المجزأة، وتقديم طريقة هجينة تجمع بين مطابقة الأنماط للنقاط الحرجة لـ ReLU-Pooling والهجوم التفاضلي الداخلي على نقاط تحول التجميع (Pooling Switching Points) الأكثر وفرة لتحقيق استعادة عالية الدقة للمعلمات بتعقيد متعدد الحدود.

Zirui Chen, Shi Tang, Zhengchao Gao, Yongjia Su, Lingyue Qin, Xiaoyang Dong2026-08-11
💻 computer science

Defending Retrieval-Augmented Intrusion Detection Against Knowledge Poisoning and Prompt Injection

تقدم هذه الورقة RAG-IDS، وهو إطار عمل متعدد الوكلاء ثلاثي الطبقات يدافع عن أنظمة كشف التسلل القائمة على التوليد المعزز بالاسترجاع ضد هجمات تسميم المعرفة وحقن الأوامر البرمجية من خلال تسجيل الثقة الناعم، والتحقق من اتساق تضمين الملصقات، وتطهير الأوامر البرمجية، مما يستعيد دقة التصنيف بفعالية مع عبء تشغيلي ضئيل.

Kaysarul Anas Apurba, Md. Hasibul Hasan, Mahedee Zaman Moon, Sk. Md. Mizanur Rahman, Atsuo Inomata2026-08-11
💻 computer science

Compositional Threat Analysis of Latent Compromise in LLM Agent Systems: The Order 66 Scenario

تقدم هذه الورقة تحليلاً أمنياً تركيبياً لأنظمة وكلاء النماذج اللغوية الكبيرة، حيث توظف سردية "الأمر 66" لتوضيح كيف يمكن لتقارب القواعد الكامنة والمتموضعة مسبقاً، مع محفزات تفعيل محددة، والسلطة التشغيلية، أن يُمكّن من حدوث اختراق ذاتي كارثي، مما يدفع للترويج لدفاعات ترتكز على وساطة القدرات، وإثبات مصدر الحالة، والاستعادة المعزولة بدلاً من الفحص أو التصفية التقليدية.

Satoshi Matsuoka2026-08-11
💻 computer science

Privacy-Preserving Data Drift Detection and Recovery for Large-Scale LLM Applications via Proxy Representations

يقدم هذا البحث ProxyDrift، وهو إطار عمل يحافظ على الخصوصية ويكتشف ويتعافى من انحراف البيانات في تطبيقات النماذج اللغوية الكبيرة (LLM) واسعة النطاق عبر تحليل تمثيلات وكيلة غير مرتبطة بمعلومات الهوية الشخصية (non-PII) لمراقبة حركة مرور الإنتاج باستمرار وتوليد مجموعات بيانات تقييم اصطناعية مستهدفة دون الوصول إلى بيانات المستخدمين الخام.

Michael Levit, Josh Ledgard, Haoyu Dong, Vishwas Suryanarayanan, Eyal Kolman, Sharon Tan, Qiang Gan, Vishal Chowdhary2026-08-11
💻 computer science

Differential Privacy for Markov Chain State Trajectories

تقدم هذه الورقة إطار عمل للخصوصية التفاضلية عبر الإنترنت لمسارات حالات سلاسل ماركوف، والذي يستفيد من الرسوم البيانية الموجهة والموزونة ومسافات المسار الأقصر لتوليد مسارات خاصة تحافظ على فائدة عالية من خلال محاكاة البيانات الحساسة عن كثب مع ضمان الاتساق الإحصائي مع سلسلة ماركوف الأساسية.

Alexander Benvenuti, Matthew Hale2026-08-11
🤖 AI

What Keeps Agent Skills from Being Reusable? Evidence from 138K SKILL.md Files

يكشف تحليل لـ 138,133 ملف SKILL.md عام أن أكثر من 90% منها تعاني من عيوب تحد من إمكانية إعادة الاستخدام — تتمثل أساساً في ضعف بيانات التوجيه الوصفية، وتضخم المحتوى، وسوء تنظيم الموارد — مما يستلزم سير عمل لضمان الجودة يجمع بين التلقين المدرك للمواصفات، والتدقيق الآلي، وبوابات السلامة لتمكين إعادة استخدام مهارات وكلاء النماذج اللغوية الكبيرة بشكل موثوق.

Chi Zhang, Yimin Liu, Xinze Chen, Ping Ji2026-08-11