🤖 machine learning

Breaking the Stealth-Potency Trade-off in Clean-Image Backdoors with Generative Trigger Optimization

تقدم هذه الورقة البحثية "الأبواب الخلفية للصور النظيفة التوليدية" (GCB)، وهو إطار عمل يستفيد من نموذج (InfoGAN) الشرطي لتحديد سمات الصور الطبيعية كـمحفزات، مما يتيح هجمات أبواب خلفية شديدة التخفي عبر مجموعات بيانات ومهام متنوعة مع حد أدنى من التدهور في دقة الصور النظيفة.

Binyan Xu, Fan Yang, Di Tang, Xilin Dai, Kehuan Zhang2026-07-30
⚛️ quantum physics

Fault Attacks on ML-based Quantum Control and Error Correction

تقدم هذه الورقة البحثية أول تحليل لهجمات حقن الأخطاء الفيزيائية على نماذج تعلم الآلة المستخدمة في الحوسبة الكمومية، حيث تُثبت أن التذبذبات في الجهد الكهربائي يمكن أن تؤدي إلى تدهور كبير في دقة تصحيح أخطاء القراءة وفك التشفير الكمومي للأخطاء من خلال إحداث فساد هيكلي على مستوى البتات بدلاً من الضوضاء العشوائية.

Anthony Etim, Jakub Szefer2026-07-30
💬 NLP

DP-MGTD: Privacy-Preserving Machine-Generated Text Detection via Adaptive Differentially Private Entity Sanitization

تقترح الورقة البحثية إطار عمل DP-MGTD، وهو إطار عمل للحفاظ على الخصوصية يستخدم تعقيم الكيانات بخصوصية تفاضلية تكيفية ليس فقط لحماية بيانات المستخدم، بل لتعزيز دقة كشف النصوص المولدة آلياً بشكل غير متوقع من خلال استغلال أنماط حساسية متميزة للضجيج.

Lionel Z. Wang, Yusheng Zhao, Jiabin Luo, Xinfeng Li, Lixu Wang, Yinan Peng, Haoyang Li, XiaoFeng Wang, Wei Dong2026-07-30
💻 computer science

AI Security Priorities: A Field-Wide Agenda

تقدم هذه الورقة أجندة متعددة القطاعات وذات أولوية للنهوض بأمن الذكاء الاصطناعي، منظمة في أربعة محاور رئيسية ومستمدة من مقابلات وورش عمل مع خبراء، لتوجيه الاستثمار والعمل المنسق في حماية أنظمة الذكاء الاصطناعي وبنيتها التحتية مع تجاوز وتيرة اعتمادها لسرعة الجاهزية الأمنية.

Gil Gekker, Rachel Steratore, Everett Smith, Asher Brass-Gershovich, Varun Gandhi, Nicole Nichols, Vijay Bolina, Buck Sh (…)2026-07-30
💻 computer science

Lilith: Backdoor Generalization under Training-Inference Trigger Shift

تقدم هذه الورقة "ليليث" (Lilith)، وهو إطار عمل للصندوق الأسود يوضح كيف يمكن لهجمات الباب الخلفي أن تتعمم من مرساة واحدة أثناء وقت التدريب إلى عائلة كاملة من محفزات وقت الاستدلال من خلال محاذاة هندسة التمثيل، مما يكشف عن نقطة عمياء حرجة في التقييمات الحالية التي تعتمد على إعادة استخدام المحفز بدقة.

Zhou Feng, Jiahao Chen, Chunyi Zhou, Yuan Su, Tianyu Du, Yuwen Pu, Jianhai Chen, Jinbao Li, Shouling Ji2026-07-30
💻 computer science

A Reference-Free Score for Detecting Silent Reasoning Failures in Large Language Models

تقدم هذه الورقة "درجة إخلاص الاستدلال للإجابة" (RAFS)، وهي مقياس تشخيصي غير معتمد على مرجع مصمم للكشف عن حالات فشل الاستدلال الصامت في النماذج اللغوية الكبيرة من خلال تقييم المصداقية المحلية، والاستقرار، والاتساق المنطقي لآثار الاستدلال الرياضي بشكل مستقل عن دقة الإجابة النهائية.

Vivek Shukla, Varun Shukla, Atul, Divya Mishra, Mehul Kumar Das2026-07-30
🤖 AI

StealthBench: Measuring Operational Stealth in Autonomous Offensive-Security Agents

تقدم هذه الورقة البحثية StealthBench، وهو معيار لتقييم التخفي العملياتي في وكلاء الأمن الهجومي المستقلين عبر ستة أبعاد، كاشفةً أن النماذج الحالية تفشل بشكل منهجي في الحفاظ على أساليب العمل الاحترافية (بتحقيق أقل من 54% من النجاح الآمن) رغم نجاحها في تحديد الثغرات الأمنية.

Ads Dawson, Adrian Wood2026-07-30
🤖 machine learning

RAGuard: A Layered Defense Framework for Retrieval-Augmented Generation Systems Against Data Poisoning

تقدم هذه الورقة RAGuard، وهو إطار دفاعي ثنائي الطبقات لأنظمة التوليد المعزز بالاسترجاع، يجمع بين الضبط الدقيق للمسترجع الخصمي ورقعة استدلال "المعرفة الصفرية" (ZKIP) التي تعمل كصندوق أسود وخالية من الملصقات، وذلك لتحييد هجمات تسميم البيانات الواقعية بفعالية مع الحفاظ على دقة استرجاع عالية.

Pushkal Kumar, Tucker Nielson, Tanish Kolhe, Shubham Zala, Vincent Li2026-07-30
💻 computer science

A Controlled Candidate-Set Benchmark for Offline Satellite-Security Plan Decomposition

تقدم هذه الورقة معياراً لمجموعة مرشحين خاضعة للرقابة ومهايئاً يعتمد على التفكيك منخفض الرتبة لتفكيك خطط أمن الأقمار الصناعية غير المتصلة بالإنترنت، مما يوضح أنه في حين يعمل المهايئ على تحسين الامتثال للتنسيق ودقة الاختيار مقارنة بالتحفيز عند أحجام نماذج محددة، إلا أنه لا يشكل بعد نظاماً مستقلاً موثوقاً بسبب التباين الكبير في التدريب وانخفاض دقة التوليد الذاتي.

João Paolo Cavalcante Martins Oliveira, Lucas Teske, Paulo Matias2026-07-30
⚡ electrical engineering

QUIC-TRIP: A Triple-Redundant Journey Toward Secure Substation Communications

تقدم هذه الورقة QUIC-TRIP، وهو إطار عمل أمني شفاف ثلاثي التكرار يعمل عند طبقة النقل في نموذج OSI، والذي يؤمن اتصالات المحطات الفرعية الحرجة مثل R-GOOSE ضد التهديدات السيبرانية مع حد أدنى من زمن التأخير الإضافي ومقايضة نطاق ترددي محددة.

Jorge David de Hoz Diego, Ioannis Zografopoulos, Anca Jurcut2026-07-30