💬 NLP

AI Security Leaderboard: Methodology, Results and Minimal Standard

تقدم هذه الورقة "المعيار الأدنى للضمانات" من FAR.AI، وهو معيار مرجعي لتقييم نماذج الذكاء الاصطناي التوليدي المتقدمة مقابل 67 تقنية لكسر الحماية (jailbreak) ثابتة عبر تهديدات CBRNE والتهديدات السيبرانية، مما يكشف أنه بينما تظل بعض النماذج مثل Claude Fable 5 وGPT-5.6 Sol قوية، فإن نماذج أخرى مثل Grok 4.5 وGemini 3.1 Pro تظهر ثغرات غير متساوية للغاية وقابلة للاستغلال يمكن معالجتها باستخدام استراتيجيات الدفاع المتعدد الطبقات الحالية.

Jasper Timm, Lukas Struppek, Ziwei Xu, Grace Cheong, Oscar Mata, Dan Zhao, Mick Yang, Isadora De Andrade, Xiaojun Jia, Y (…)2026-08-05
💻 computer science

FakeI2V-Bench: Benchmarking the Applicability of Image-level Deepfake Detectors for Deepfake Video Detection

تقدم الورقة البحثية FakeI2V-Bench، وهو معيار شامل يتكون من ما يقرب من 100,000 فيديو تم إنشاؤها بواسطة نماذج متقدمة لتقييم كواشف التزييف العميق، كاشفةً أن الكواشف على مستوى الصورة يمكن أن تتفوق على تلك التي تعمل على مستوى الفيديو، ومقترحةً إطار عمل IV-Bridge لتعزيز قدرات الكشف عن الفيديو بشكل كبير.

Pei Li, Sihan Chen, Delong Ran, Tianshuo Cong2026-08-05
💻 computer science

PECR: A Reproducible Specification and Synthetic Stress Test of Telemetry-Informed Vulnerability Prioritization for SD-WAN

تقدم هذه الورقة PECR، وهو مواصفات قابلة للتكرار واختبار إجهاد اصطناعي لطريقة تحديد أولويات الثغرات الأمنية القائمة على القياس عن بُعد والتي تدمج تسعة عوامل لتحسين اتخاذ القرار مقارنة بالنهج التقليدي المعتمد على الخطورة فقط، مع الإشارة صراحةً إلى أن تقييمها يعتمد على بيانات اصطناعية بدلاً من التحقق من النتائج في العالم الحقيقي.

Saeed Alam2026-08-05
💻 computer science

AirKey: Multimodal Acoustic-Assisted WiFi Sensing for Zero-Training Robust PIN Inference

يُعد AirKey إطار عمل مبتكرًا لا يتطلب تدريبًا، يتغلب على قيود النشر والغموض التي تفرضها تقنيات استشعار الواي فاي الصرفة من خلال الجمع بين حصاد مؤشرات حالة القناة (CSI) السلبي والخالي من الشبكة من استجابات (ACK) مع الإشارات الصوتية للتقسيم الزمني الدقيق، مما يتيح استنتاجًا عالي الدقة ومتخفيًا لرمز التعريف الشخصي (PIN).

BaiChuan Wu, Bin Liu, Xiang Zhang, Zhi Liu, Jie Zhang, Chao Liu, Huan Yan, Meng Li, Fusang Zhang2026-08-05
💻 computer science

Attacking and Defending Multi-Agent Collaborative Filtering Systems Through Connectivity

تبحث هذه الورقة في كيفية تأثير عوامل الاتصال — وتحديداً عدد المرشحين وتركيز الكتالوج — على فعالية الهجمات والدفاعات في أنظمة التصفية التعاونية متعددة الوكلاء من خلال تكييف وتقييم الاستراتيجيات المستوحاة من الأنظمة متعددة الوكلاء (MAS) ضمن إطار عمل AgentCF.

Anjun Hu, Hanting Xie, Saranya Govindan, Jas Kandola, Kurt Cutajar2026-08-05
💻 computer science

Right Divisibility in Erasing Semi-Thue Systems: A Minimal View of Intruder Deduction

تتقصى هذه الورقة مشكلة استنتاج المتسلل من خلال منظور القابلية للقسمة من جهة اليمين في أنظمة "سي-ثي" (semi-Thue)، حيث تُرسخ نتائج جديدة حول قابلية التقرير لأنظمة محو البادئات والنهايات المتقاربة، بينما تُبين أن المشكلة تصبح غير قابلة للتقرير حتى بالنسبة للأنظمة المتقاربة التي تتضمن رفع المتغيرات المتزامن.

Raja Oktovin O. P. Damanik, Alwen Tiu2026-08-05
🔢 mathematics

Breaking ACDGV MinRank Gabidulin encryption schemes over matrix codes

تقدم هذه الورقة هجوماً لاستعادة المفتاح في وقت حدودي يكسر جميع مجموعات المعلمات المقترحة لمخطط تشفير أكواد مصفوفة غابيدولين المحسنة (EGMC) عبر الجمع بين التقنيات التوافقية والجبرية لاستعادة مفتاح سري مكافئ، مما يقلل مستوى الأمان المزعوم البالغ 128 بت إلى 35 بت فقط.

Thai Hung Le2026-08-05
💻 computer science

SkillJack: Persistent Skill Backdoors in Self-Evolving Agents

تقدم هذه الورقة SkillJack، وهو هجوم مبتكر يستغل مسار "الخبرة إلى المهارة" للوكلاء ذاتيي التطور لتحويل التفاعلات المسمومة إلى سلوكيات خبيثة مستمرة وغير قابلة للكشف، تنجو من إزالة السجلات المصدرية وتتجنب فلاتر السلامة.

Zonghao Ying, Xiangfan Wu, Huiyu Wu, Xing Zheng, Huangsheng Cheng, Xiaorong Shi, Jing Guo2026-08-05
💻 computer science

A Challenge-Nonce Freshness Gap in Project Veraison's TPM Reference Schemes, Found by Appraising Application-Layer Action Evidence End-to-End

تقدم هذه الورقة عملية تحقق شاملة لمخططات مرجع TPM الخاصة بمشروع "Veraison" لإثبات أدلة إجراءات طبقة التطبيقات، مما يكشف ويصلح ثغرة حرجة تتعلق بحداثة الـ "challenge-nonce" كانت تسمح سابقاً بقبول الاقتباسات المعاد تشغيلها كأنها صالحة بشكل غير صحيح.

Anton Sokolov2026-08-05
💻 computer science

DiagChain: A Diagnostic Benchmark for Evaluating LLM Agents on Evidence-Grounded Attack Chain Reconstruction

تقدم الورقة البحثية DiagChain، وهو معيار تشخيصي يضم 69 سيناريو متنوعًا وإطار عمل ECRAG لتقييم وكلاء النماذج اللغوية الكبيرة (LLMs) في إعادة بناء سلسلة الهجمات القائمة على الأدلة، كاشفةً أنه في حين تعاني النماذج الأكبر من صعوبة في ترتيب الأدلة، تفشل النماذج الأصغر في عملية دمج الأدلة الأساسية، مما يسلط الضوء على الحاجة إلى التقييم المرحلي بدلاً من الدقة الإجمالية.

Xuyang Liu, Yibin Han, Zhenwei Zhang, Kai Chang, Zhiwei Xu, Tian Qiu, Weixian Deng, Jiabao Gao, Xiaolin Peng, Hai Wan, X (…)2026-08-05