💻 computer science

On the Geometric Limits of Transformer Defenses against Obfuscation Attacks: Latent Embedding Collapse & Performance Robustness Gap

تكشف هذه الورقة أنه على الرغم من تحقيق أداء تصنيف يقترب من المثالية، إلا أن دفاعات حقن الأوامر الحالية تعاني من "فجوة أداء-متانة" حرجة، حيث تتسبب المطالبات المموّهة متعددة العمليات في انهيار التضمين الكامن وهشاشة هندسية تفشل المقاييس القياسية في اكتشافها.

Becky Mashaido, Tapadhir Das2026-05-20
🤖 AI

Hallucination as Exploit: Evidence-Carrying Multimodal Agents

تقدم هذه الورقة البحثية "الوكلاء متعددون الوسائط حاملو الأدلة" (ECA)، وهي بنية آمنة تمنع إخفاقات التفويض الناجمة عن الهلوسة من خلال اشتراط التحقق من استدعاءات الأدوات مقابل شهادات أدلة خارجية محددة النوع، بدلاً من الاعتماد على الادعاءات الإدراكية غير المتحقق منها للنموذج.

Guijia Zhang, Hao Zheng, Harry Yang2026-05-20
⚡ electrical engineering

Detecting and Mitigating Backdoor Attacks in OTA-FL Systems: A Two-Stage Robust Aggregation Scheme

تقترح هذه الورقة إطار تجميع قوي ثنائي المراحل يجمع بين تسجيل الثقة المدرك للنمط وآليات الوصول المتعدد القائمة على الثقة وآليات السمعة الطولية للكشف بفعالية عن هجمات الباب الخلفي والتخفيف من حدتها في أنظمة التعلم الاتحادي عبر الهواء مع الحفاظ على دقة المهمة الرئيسية.

Xiaoyan Ma, Seohyun Lee, Taejoon Kim, Christopher G. Brinton2026-05-20
💻 computer science

MultiBallot: Verifiable and privacy-preserving E-Collecting in the Swiss setting

تقترح هذه الورقة بروتوكولاً آمناً، يحافظ على الخصوصية، وقابلاً للتحقق لعمليات جمع التوقيعات الإلكترونية في سويسرا، وذلك عبر الاستفادة من الطبيعة المتوازية لعمليات الجمع النشطة المتعددة لضمان خصوصية المشاركة دون الحاجة إلى قناة مجهولة.

Florian Moser, Léo Louistisserand2026-05-20
🤖 AI

Exploring and Developing a Pre-Model Safeguard with Draft Models

تقترح هذه الورقة وسيلة حماية ما قبل النموذج تستفيد من قابلية انتقال هجمات كسر الحماية من النماذج اللغوية الكبيرة إلى نماذج المسودة الأصغر لتوليد استجابات مسودة، مما يمكّن الحواجز الموجودة من اكتشاف المطالبات غير الآمنة بدقة أكبر قبل استدلال النموذج المستهدف مع تجنب التكاليف الحسابية العالية للتدقيق ما بعد النموذج.

Hongyu Cai, Arjun Arunasalam, Yiming Liang, Antonio Bianchi, Z. Berkay Celik2026-05-20
💻 computer science

RoboJailBench: Benchmarking Adversarial Attacks and Defenses in Embodied Robotic Agents

تقدم هذه الورقة RoboJailBench، وهو أول إطار تقييم معياري لهجمات كسر الحماية في أنظمة الذكاء الاصطناعي المتجسد، والذي يعالج الفجوات الحالية من خلال إنشاء تصنيف أمني، وإنشاء مسار بيانات لتباين النوايا، وتوفير مقاييس موحدة لتقييم المقايضة بين الأمان والمنفعة في نماذج الرؤية واللغة المتجسدة.

Doguhuan Yeke, Yanming Zhou, Leo Y. Lin, Hongyu Cai, Antonio Bianchi, Z. Berkay Celik2026-05-20
💻 computer science

Locked Out at 8,000 Miles: Why UK-China Partnership Students Are Suffering

تجادل هذه الورقة بأنه في حين أن تدابير الأمن السيبراني الجامعية المكثفة تخلق عوائق في إمكانية الوصول لجميع الطلاب، إلا أنها تضعف بشكل غير متناسب طلاب الشراكات الدولية — لا سيما أولئك المنضوين تحت البرامج البريطانية الصينية — من خلال جعل الموارد الرقمية الأساسية غير قابلة للوصول بسبب التفاوت في المناطق الزمنية، ونقص الدعم التقني في الموقع، وبروتوكولات المصادقة الصارمة التي لا تراعي المتعلمين عن بُعد.

Benjamin Kenwright2026-05-20
💻 computer science

XAI FL-IDS: A Federated Learning and SHAP-Based Explainable Framework for Distributed Intrusion Detection Systems

تقترح هذه الورقة إطار عمل XAI FL-IDS، وهو إطار مبتكر يدمج التعلم الاتحادي مع القابلية للتفسير القائمة على SHAP لتمكين كشف التسلل الموزع عالي الدقة والمحافظ على الخصوصية، مع توفير رؤى شفافة حول عمليات اتخاذ القرار.

Mohammad Hossein Gholamrezazadeh, AhmadReza Montazerolghaem2026-05-20
💻 computer science

Security Analysis of Bitcoin's V2 Transport Protocol: Exploiting Design Implications for Sustained Eclipse and Downgrade Attacks

تحلل هذه الورقة بروتوكول النقل (P2P) الجديد الإصدار الثاني (V2) لشبكة بيتكوين، كاشفةً أنه على الرغم من تخفيفه للثغرات المعروفة، إلا أن عيوب التصميم المفاهيمي لا تزال تمكّن المهاجمين على مستوى الشبكة من تنفيذ هجمات كسر العزلة (eclipse) وهجمات خفض المستوى (downgrade) مستمرة، مما يستدعي اقتراح تدابير مضادة جديدة.

Charmaine Ndolo, Florian Tschorsch2026-05-20
🤖 AI

Measuring Safety Alignment Effects in Autonomous Security Agents

تقدم هذه الورقة معياراً قائماً على التتبع لتقييم كيفية تأثير محاذاة السلامة على وكلاء الأمن المستقلين، كاشفةً أنه في حين يمكن لمشتقات النماذج غير المقيدة أن تحسن بشكل كبير من اكتشاف الثغرات والترسيخ في حالات محددة مثل Gemma، إلا أن هذه المكاسب ليست عالمية عبر جميع النماذج أو المهام، وتبرز الحاجة إلى مقاييس سلامة على مستوى النظام تتجاوز مجرد معدلات الرفض البسيطة.

Isaac David, Arthur Gervais2026-05-20