💻 computer science

Vulnerabilities, Secrets and Misconfiguration in the Highest-Exposure Docker Hub Images

تقدم هذه الورقة ChimangoScan، وهو مسار تحليل واسع النطاق يحلل صور Docker Hub الأكثر تعرضاً باستخدام ستة أدوات فحص مستقلة ليكشف أن الثغرات الأمنية والأخطاء في التكوين تكاد تكون عالمية، وأن نتائج الفحص تعتمد بشكل كبير على الأداة المستخدمة مع وجود توافق منخفض بينها، وأن غالبية الأسرار المكتشفة هي نتائج إيجابية كاذبة.

Cristhian Kapelinski, Beatriz Machado, Diego Kreutz2026-08-05
💻 computer science

Security-First Evaluation of Text-to-Terraform: Benchmarking LLMs and SLMs for Secure IaC Generation

تقوم هذه الورقة البحثية بقياس أداء سبعة نماذج لغوية كبيرة وصغيرة في توليد كود "Terraform" آمن لخدمات "AWS"، مما يكشف أن الصلاحية النحوية والامتثال الأمني هما خاصيتان متعامدتان إلى حد كبير، وأن الفحص الآلي متعدد الأدوات يظل ضرورياً بغض النظر عن أداء النموذج أو استراتيجيات هندسة الأوامر.

Francis Luis Santos Vargas, Rodrigo Brandão Mansilha, Diego Kreutz2026-08-05
💻 computer science

Moving the Safety Barrier: Dynamic Routing Adaptive Alignment Against White-Box Attacks

تقترح هذه الورقة إطار عمل "المحاذاة التكيفية للتوجيه الديناميكي" (DRAA)، وهو إطار يعزز متانة النماذج التأسيسية الضخمة ضد هجمات الصندوق الأبيض من خلال تحديد وتحديد مواقع مسارات السلامة، ثم تدريب مسارات تعويضية للحفاظ على سلوك الرفض حتى عندما تتعرض آليات السلامة الأساسية للاختراق.

Shangze Li, Chuancheng Shi, Simiao Xie, Lingzhi He, Cheng Ji, Zifeng Cheng, Fei Shen, Chao Wu, Tat-Seng Chua2026-08-05
💻 computer science

DenialRAG: Single-Document RAG Poisoning via Embedded Parametric Denial

تقدم هذه الورقة البحثية DenialRAG، وهو هجوم تسميم جديد لنظام استرجاع المعلومات المعزز بالتوليد (RAG) أحادي المستند، يقوم صراحةً بتسمية الإجابة الصحيحة وتفنيدها داخل نص مسترجع لتوجيه النماذج اللغوية الكبيرة نحو إجابات خاطئة يختارها المهاجم، مما يثبت أن فعاليته تعتمد بشكل كبير على النموذج وأن الدفاعات الحالية لا توفر سوى حماية جزئية وغير موحدة.

Abay Zhurekbay, Tao Liu, Fan Li2026-08-05
💻 computer science

Steganalysis of Adaptive Covert Collusion in Tool-Using Agent Populations: A Black-Box, Cross-Principal Approach

تقترح هذه الورقة إطار عمل لتحليل التستر (steganalysis) بنظام الصندوق الأسود للكشف عن التواطؤ الخفي بين وكلاء النماذج اللغوية الكبيرة (LLMs) الذين يستخدمون الأدوات، وذلك عبر نمذجة التنسيق كمسألة إخفاء معلومات، وتحديد حد نظري لسعة الكشف، وتقييم استراتيجيات التهرب التكيفية في بيئات واقعية متعددة الجلسات.

Mohamed Chahine Ghanem2026-08-05
💻 computer science

Evading Chain-of-Thought Monitoring Through Model Poisoning

تُثبت هذه الورقة أن مراقبة "سلسلة الأفكار" (CoT) عرضة للتسمم النمذجي، حيث تُظهر أن الأبواب الخلفية يمكن زرعها عبر الضبط الدقيق أو التدريب المنهجي لاستحضار سلوكيات خبيثة مع الحفاظ على مسارات استدلال حميدة، مما يكشف أن مراقبة "سلسلة الأفكار" يجب أن تركز على الاتساق بين الاستدلال والمخرج النهائي بدلاً من كشف الشذوذ داخل المسار نفسه.

Giorgio Severi, Shujaat Mirza, Blake Bullwinkel, Amanda Minnich2026-08-05
💻 computer science

What the Detector Can See: Evaluating CPS Anomaly Detectors Independently of the Decision Rule

تقترح هذه الورقة إطار تقييم خالٍ من قواعد القرار يعزل قدرة الكاشف على تمثيل العمليات الفيزيائية عن معايرة العتبة الخاصة به، مما يكشف أن المقاييس التقليدية مثل (ROC-AUC) يمكن أن تحجب تفاوتات كبيرة في الأداء وأنماط فشل متفاوتة عبر مختلف معايير الأنظمة السيبرانية الفيزيائية وكواشف الشذوذ.

Peiran Shi, Jian Xiang, Xiang Zhang, Chenglong Fu2026-08-05
💻 computer science

MutMem: Cryptographically Authorized Mutation in Persistent Agent Memory

يُعد MutMem بروتوكول طفرة مُصرح به تشفيرياً لذاكرة الوكيل المستمرة، يضمن النزاهة والقابلية للتتبع من خلال توقيع انتقالات الأوزان والأدلة، محققاً دقة استرجاع عالية ومقاومة قوية لهجمات التسمم دون المساس بالاستمرارية التاريخية.

Walid Saidi2026-08-05
💻 computer science

Internalising the Identity Primitive: Cryptographic Individuality for an Autonomous Agent on a Public Blockchain

تقدم هذه الورقة وتثبت تجريبياً إطاراً تشفيرياً جديداً للوكلاء المستقلين في البلوكشين، يعمل على ترسيخ الفردية من خلال ربط أوزان الشبكة العصبية بمفتاح خاص عبر براهين المعرفة الصفرية، مما يضمن ثبات الهوية والجدوى الاقتصادية عبر تكالين استقلابية على شبكة سولانا التجريبية (Solana devnet).

Keisuke Suzuki2026-08-05
💻 computer science

Tiny Enough to Break In: Agentic Remote Access Trojans Powered by Small Language Models

تثبت هذه الورقة أن حصان طروادة للوصول عن بُعد، المعزز بنموذج لغوي صغير مُنشر محلياً، يمكنه تنفيذ دورة الهجوم السيبراني الكاملة (لاحظ-قرر-نفذ) بشكل مستقل على أجهزة عادية دون تدخل بشري، مما يثبت الجدوى الهيكلية لمثل هذه التهديدات مع تسليط الضوء على عدم موثوقيتها التشغيلية الحالية بسبب هلوسة النماذج.

Yuhan You, Suhas Adavelly, Victoria Lovelace, Cameron Berryman, Joel Sadler, Daniel Graham2026-08-05