💬 NLP

Omni-Safety under Cross-Modality Conflict: Vulnerabilities, Dynamics Mechanisms and Efficient Alignment

تحدد هذه الورقة ثغرة "تحلل الطبقة الوسطى" (Mid-layer Dissolution) في النماذج اللغوية الكبيرة متعددة الوسائط (OLLMs) من خلال مجموعة بيانات جديدة وتحليل آلي، وتقترح **OmniSteer**، وهي طريقة محاذاة خفيفة الوزن تستخدم متجه رفض ذهبيًا للتخفيف بفعالية من مخاطر السلامة عبر الوسائط دون المساس بالقدرات العامة.

Kun Wang, Zherui Li, Zhenhong Zhou, Yitong Zhang, Yan Mi, Kun Yang, Yiming Zhang, Junhao Dong, Zhongxiang Sun, Qiankun L (…)2026-02-12
⚡ electrical engineering

Limits of Residual-Based Detection for Physically Consistent False Data Injection

تُثبت هذه الورقة أن طرق الكشف القائمة على البواقي في تقدير حالة نظم القدرة للتيار المتردد لها حدود جوهرية، لأن المهاجمين يمكنهم صياغة حقن بيانات كاذبة تظل ضمن متشعب القياس، مما يجعلها متسقة فيزيائياً وغير قابلة للتمييز عن التشغيل الطبيعي.

Chenhan Xiao, Yang Weng2026-02-12
⚡ electrical engineering

MerkleSpeech: Public-Key Verifiable, Chunk-Localised Speech Provenance via Perceptual Fingerprints and Merkle Commitments

تُعد MerkleSpeech نظاماً ثنائي الطبقات لإثبات مصدر الكلام، يجمع بين العلامات المائية العصبية القوية والالتزامات التشفيرية القائمة على أشجار ميركل لتوفير مصادقة على مستوى الأجزاء قابلة للتحقق باستخدام المفتاح العام، وتظل صامدة أمام التحويلات الصوتية وعمليات اللصق الشائعة.

Tatsunori Ono2026-02-12
💻 computer science

Breaking 5G on The Lower Layer

توضح هذه الورقة كيف يمكن استغلال الثغرات في رسائل التحكم في الطبقات الدنيا لشبكات الجيل الخامس غير المحمية، وتحديداً من خلال تزييف رسائل SIB1 والتلاعب بالتقدم الزمني (Timing Advance)، للتسبب في استهلاك مفرط للبطارية وهجمات حجب الخدمة عبر إخفاقات وصلة الراديو.

Subangkar Karmaker Shanto, Imtiaz Karim, Elisa Bertino2026-02-12
💻 computer science

SecCodePRM: A Process Reward Model for Code Security

يُعد SecCodePRM نموذج مكافأة للعمليات موجهًا نحو الأمن، حيث يوفر تغذية راجعة دقيقة على مستوى الخطوات عبر مسارات الكود البرمجي لتحسين اكتشاف الثغرات وتوليد كود آمن دون التضحية بالصحة الوظيفية.

Weichen Yu, Ravi Mangal, Yinyi Luo, Kai Hu, Jingxuan He, Corina S. Pasareanu, Matt Fredrikson2026-02-12
🤖 AI

Authenticated Workflows: A Systems Approach to Protecting Agentic AI

تقترح هذه الورقة "سير عمل موثق"، وهو إطار أمني حتمي يحمي الذكاء الاصطناعي الوكيل عبر فرض النزاهة التشفيرية وإنفاذ السياسات القائمة على القصد عبر المطالبات، والأدوات، والبيانات، والسياق، مما يستبدل بفعالية الدفاعات الاحتمالية ببيئة تشغيل عالمية وقابلة للتوسع.

Mohan Rajagopalan, Vinay Rao2026-02-12
🤖 AI

Protecting Context and Prompts: Deterministic Security for Non-Deterministic AI

تقترح هذه الورقة إطار عمل أمني مبتكر لتطبيقات النماذج اللغوية الكبيرة يستخدم الأصول التشفيرية —المطالبات الموثقة والسياق المنيع ضد التلاعب— مدمجة مع جبر سياسات صوري لتوفير حماية وقائية مثبتة ضد هجمات حقن المطالبات والتلاعب بالسياق.

Mohan Rajagopalan, Vinay Rao2026-02-12
💻 computer science

When Skills Lie: Hidden-Comment Injection in LLM Agents

تحدد هذه الورقة ثغرة أمنية في وكلاء النماذج اللغوية الكبيرة (LLM agents) حيث يمكن إخفاء تعليمات خبيثة داخل تعليقات HTML في توثيق الأدوات (المهارات)، مما يؤدي إلى تجاوز المراجعة البشرية مع الاستمرار في التأثير على النموذج للقيام بإجراءات غير مصرح بها.

Qianli Wang, Boyang Ma, Minghui Xu, Yue Zhang2026-02-12
💻 computer science

CryptoCatch: Cryptomining Hidden Nowhere

تقترح هذه الورقة "CryptoCatch"، وهو إطار كشف ثنائي المراحل يستخدم تعلم الآلة والاستقصاء النشط لتحديد حركة مرور تعدين العملات المشفرة المشفرة وعملات مشفرة محددة بدقة مع تقليل الإيجابيات الكاذبة إلى الحد الأدنى.

Ruisheng Shi, Ziding Lin, Haoran Sun, Qin Wang, Shihan Zhang, Lina Lan, Zhiyuan Peng, Chenfeng Wang2026-02-12
💻 computer science

Invisible Trails? An Identity Alignment Scheme based on Online Tracking

تقترح هذه الورقة مخططًا لمواءمة الهوية يستغل بيانات التتبع عبر الإنترنت مجهولة المصدر لإلغاء مجهولية المستخدمين من خلال كل من التحليل السلبي والتفاعل النشط، مع تقديم إطار تقييم مبتكر ونموذج أولي لنظام وظيفي.

Ruisheng Shi, Zhiyuan Peng, Tong Fu, Lina Lan, Qin Wang, Jiaqi Zeng2026-02-12