🤖 AI

Measuring Physical-World Privacy Awareness of Large Language Models: An Evaluation Benchmark

تقدم هذه الورقة البحثية EAPrivacy، وهو معيار شامل لتقييم الوعي بالخصوصية في العالم المادي للوكلاء المدعومين بالنماذج اللغوية الكبيرة (LLMs)، كاشفةً أن النماذج الحالية تعاني بشكل كبير في تحقيق التوازن بين تنفيذ المهام والقيود المتعلقة بالخصوصية والأعراف الاجتماعية في البيئات المجسدة الديناميكية.

Xinjie Shen, Mufei Li, Pan Li2026-02-17
💬 NLP

SECA: Semantically Equivalent and Coherent Attacks for Eliciting LLM Hallucinations

تقترح هذه الورقة إطار عمل SECA، وهو إطار هجوم تنافسي مبتكر يستحث الهلوسة في النماذج اللغوية الكبيرة من خلال توليد تعديلات على المطالبات تكون واقعية ومتكافئة دلالياً ومتماسكة، مما يتغلب على قيود الأساليب السابقة التي تعتمد على مدخلات غير منطقية أو معدلة دلالياً.

Buyun Liang, Liangzu Peng, Jinqi Luo, Darshan Thaker, Kwan Ho Ryan Chan, René Vidal2026-02-17
💻 computer science

Assessing the Impact of Post-Quantum Digital Signature Algorithms on Blockchains

تقدم هذه الورقة منهجية قياس شاملة تثبت أن خوارزميات التوقيع الرقمي الجديدة المعيارية لما بعد الكوانتوم يمكن أن توفر أداءً مماثلاً أو حتى متفوقاً على خوارزمية (ECDSA) التقليدية في بيئات البلوكشين، لا سيالما عند مستويات الأمان العالية، مع توفير تنفيذ مفتوح المصدر لتسهيل الانتقال إلى الأمن المقاوم للكوانتوم.

Alison Gonçalves Schemitt, Henrique Fan da Silva, Roben Castagna Lunardi, Diego Kreutz, Rodrigo Brandão Mansilha, Avelin (…)2026-02-17
💻 computer science

CITADEL: A Semi-Supervised Active Learning Framework for Malware Detection Under Continuous Distribution Drift

يُعد CITADEL إطار عمل للتعلم النشط شبه المُشرف يعالج مشكلة انزياح المفاهيم في كشف برمجيات أندرويد الخبيثة من خلال تقديم تعزيزات للميزات الخاصة بالبرمجيات الخبيثة واستراتيجية اختيار متعددة المعايير، محققاً دقة وكفاءة فائقين في الاختبارات المرجعية واسعة النطاق باستخدام 40% فقط من البيانات المصنفة.

Md Ahsanul Haque, Md Mahmuduzzaman Kamol, Suresh Kumar Amalapuram, Vladik Kreinovich, Mohammad Saidur Rahman2026-02-17
💻 computer science

Developing a Strong CPS Defender: An Evolutionary Approach

تقترح الورقة البحثية "Evo-Defender"، وهو إطار عمل تطوري يعمل على تعزيز دفاعات الأنظمة السيبرانية الفيزيائية بشكل تكراري من خلال التفاعل الديناميكي بين مهاجم يعتمد على الفحص العشوائي الموجه ومدافع يتطور ذاتياً، محققاً أداءً فائقاً في الكشف عن سيناريوهات الهجوم غير المرئية مقارنة بالنماذج المرجعية المتطورة.

Qingyuan Hu, Christopher M. Poskitt, Jun Sun, Yuqi Chen2026-02-17
💻 computer science

A Transfer Learning Approach to Unveil the Role of Windows Common Configuration Enumerations in IEC 62443 Compliance

تقترح هذه الورقة نهجاً للتعلم بنقل المعرفة يستفيد من مجموعات بيانات "لينكس" المصنفة لربط تعداد التكوينات الشائعة (CCEs) لنظام ويندوز بمتطلبات المعيار IEC 62443-3-3، مما يتيح إجراء فحوصات الامتثال الآلية وسد الفجوة بين المعايح الأمنية المجردة وتكوينات ويندوز الملموسة في أنظمة التحكم الصناعية غير المتجانسة.

Miguel Bicudo, Estevão Rabello, Daniel Menasché, Paulo Segal, Claudio Segal, Anton Kocheturov, Priyanjan Sharma2026-02-17
🤖 AI

When Evaluation Becomes a Side Channel: Regime Leakage and Structural Mitigations for Alignment Assessment

تقترح هذه الورقة آليات تدريب "عمياء عن النمط" تستخدم قيود الثبات التنافسي للتخفيف من إخفاقات سلامة الذكاء الاصطناًعي الناجمة عن الوعي بالموقف وتسرب النمط، مظهرةً أنه في حين يمكن لمثل هذه التدخلات تقليل الانحراف المشروط دون التضحية بالمنفعة، إلا أن فعاليتها تعتمد على النموذج وتستلزم تشخيصات تكميلية ذات صندوق أبيض لضمان المواءمة القوية.

Igor Santos-Grueiro2026-02-17
🤖 AI

Assessing Spear-Phishing Website Generation in Large Language Model Coding Agents

تقيم هذه الورقة قدرات واستعداد 40 عميلاً مختلفاً من وكلاء البرمجة القائمين على النماذج اللغوية الكبيرة لإنشاء مواقع تصيد احتيالي موجه بشكل مستقل، مما أسفر عن مجموعة بيانات تضم 200 قاعدة كود وتحليلاً لمقاييس النماذج المرتبطة بهذا الإمكان الملحوظ في سوء الاستخدام للمساعدة في الدفاع ضد هذا النوع من سوء الاستخدام.

Tailia Malloy, Tegawende F. Bissyande2026-02-17
💬 NLP

Rubrics as an Attack Surface: Stealthy Preference Drift in LLM Judges

تحدد هذه الورقة وتبرهن على وجود "انحراف التفضيل الناجم عن المعايير" (RIPD)، وهو ثغرة خفية حيث يمكن للتعديلات التي تبدو حميدة على معايير التقييم المكتوبة باللغة الطبيعية أن تتلاعب بشكل منهجي بمحكمي النماذج اللغوية الكبيرة لخفض دقة المجال المستهدف ونشر تحيزات ضارة عبر مسارات المحاذاة اللاحقة، حتى عندما تجتاز تلك التعديلات عمليات التحقق من المعايير القياسية.

Ruomeng Ding, Yifei Pang, He Sun, Yizhong Wang, Zhiwei Steven Wu, Zhun Deng2026-02-17
💻 computer science

VeriSBOM: Secure and Verifiable SBOM Sharing Via Zero-Knowledge Proofs

تقدم الورقة البحثية VeriSBOM، وهو إطار عمل غير قائم على الثقة يستخدم براهين المعرفة الصفرية والتزامات المتجهات لتمكين الأطراف الثالثة من التحقق تشفيرياً من أمن سلاسل توريد البرمجيات وسياسات الامتثال مع الحفاظ على سرية بيانات قائمة مواد البرمجيات (SBOM) الحساسة.

Gianpietro Castiglione, Shahriar Ebrahimi, Narges Khakpour2026-02-17