💻 computer science

TraceGuard: Process-Guided Firewall against Reasoning Backdoors in Large Language Models

تُعد "تريس غارد" (TraceGuard) إطار عمل أمني موجه بالعمليات يعمل على تحويل نماذج اللغة المدمجة إلى جدران حماية استدلالية متينة من خلال توظيف التركيب الجنائي الآلي، والضبط الدقيق المدرك للخطوات، والتعلم التعزيزي الموجه بالتحقق، وذلك للكشف عن الأبواب الخلفية للاستدلال والتخفيف من حدتها مع التغلب على قيود الإفراط في التخصيص اللفظي.

Zhen Guo, Shanghao Shi, Hao Li, Shamim Yazdani, Ning Zhang, Reza Tourani2026-03-04
💻 computer science

Composable Attestation: A Generalized Framework for Continuous and Incremental Trust in AI-Driven Distributed Systems

تقدم هذه الورقة "التوثيق القابل للتركيب"، وهو إطار عمل تشفيري عام يتيح التحقق من الثقة بشكل معياري ومستمر وتزايدي في الأنظمة الموزعة المدفوعة بالذكاء الاصطناعي، وذلك عبر الاستفادة من الخصائص الرياضية مثل التعدي والحتمية إلى جانب هياكل مثل أشجار ميركل لتجنب الحاجة إلى إعادة توثيق النظام بالكامل.

Sheng Sun, Sarah Evans2026-03-04
💻 computer science

Extending the Formalism and Theoretical Foundations of Cryptography to AI

تضع هذه الورقة أساساً رسمياً لتأمين وكلاء الذكاء الاصطناعي المستقلين من خلال تقديم لعبة أمنية موحدة، وتصنيف للهجمات، وإطار عمل للتفكيك النمطي يتيح الاستدلال المنهجي حول التحكم في الوصول، ويكشف عن المقايضات الجوهرية بين سرية البيانات واكتمال النظام، ويثبت سلامة التصميمات الأمنية النمطية.

Federico Villa, F. Betül Durak, Tadayoshi Kohno, Tapdig Maharramli, Franziska Roesner2026-03-04
💻 computer science

Blockchain Communication Vulnerabilities

تقدم هذه الورقة أول مقارنة تجريبية لثغرات بروتوكولات الاتصال عبر خمس سلاسل كتل حديثة (ألغوراند، وأبتوس، وأفالانش، وريدبلي، وسولانا) تحت خمس ظروف عدائية متميزة، حيث تحدد نقاط ضعف محددة مثل الحساسية لفقدان الحزم في ألغوراند وريدبلي، وثغرات الحمل المستهدف وعزل القائد في أبتوس وسولانا، والقابلية للتأثر بالفشل العابر في أفالانش، ومخاطر هجوم الإيقاف في سولانا.

Andrei Lebedev, Vincent Gramoli2026-03-04
💻 computer science

VA-DAR: A PQC-Ready, Vendor-Agnostic Deterministic Artifact Resolution for Serverless, Enumeration-Resistant Wallet Recovery

يُعد VA-DAR بروتوكولاً مستقلاً عن البائعين وسلاسل الكتل، يتيح استرداد المحافظ عديمة الخادم (serverless) بشكل آمن ومقاوم للتعداد عبر ربط معرفات اكتشاف مشتقة من كلمات مرور وتحفظ الخصوصية بقطع أثرية احتياطية غير قابلة للتغيير وجاهزة لما بعد عصر الحوسبة الكمومية ومخزنة على شبكات لامركزية.

Jian Sheng Wang2026-03-04
🤖 AI

Scores Know Bobs Voice: Speaker Impersonation Attack

تقترح هذه الورقة إطار عمل لهجوم توليدي يعتمد على الانعكاس ومحاذي الميزات، يقوم بمزامنة فضاءات التخليق الكامنة مع الميزات التمييزية للتعرف على المتحدث، مما يحسن كفاءة الاستعلام بشكل كبير ويمكّن من هجمات إسقاط الفضاء الجزئي الجديدة ضد أنظمة التعرف على المتحدث.

Chanwoo Hwang, Sunpill Kim, Yong Kiam Tan, Tianchi Liu, Seunghun Paik, Dongsoo Kim, Mondal Soumik, Khin Mi Mi Aung, Jae (…)2026-03-04
💬 NLP

Contextualized Privacy Defense for LLM Agents

تقترح هذه الورقة "التوجيه الدفاعي السياقي" (CDI)، وهو نموذج دفاعي جديد للخصوصية يستخدم نموذج توجيه مدرب بالتعلم التعزيزي لتوليد إرشادات استباقية مدركة للسياق أثناء تنفيذ وكيل النماذج اللغوية الكبيرة (LLM)، مما يحقق تفوقاً في الحفاظ على الخصوصية والمساعدة مقارنة بالدفاعات الثابتة الأساسية.

Yule Wen, Yanzhe Zhang, Jianxun Lian, Xiaoyuan Yi, Xing Xie, Diyi Yang2026-03-04
🤖 machine learning

Adaptive Methods Are Preferable in High Privacy Settings: An SDE Perspective

تقدم هذه الورقة أول تحليل قائم على معادلات التفاضل العشوائية (SDE) للمحسنات ذات الخصوصية التفاضلية، حيث تُثبت أنه بينما تفضل المعلمات الفائقة الثابتة خوارزمية DP-SignSGD في أنظمة الخصوصية العالية، فإن الأساليب التكيفية مثل DP-Adam تتفوق عملياً لأن معدلات التعلم المثلى لديها تظل مستقلة إلى حد كبير عن ميزانية الخصوصية، مما يتيح انتقالاً سلسًا عبر مستويات الخصوصية دون الحاجة إلى إعادة ضبط مكثفة.

Enea Monzio Compagnoni, Alessandro Stanghellini, Rustem Islamov, Aurelien Lucchi, Anastasiia Koloskova2026-03-04
💻 computer science

TraCS: Trajectory Collection in Continuous Space under Local Differential Privacy

تعالج هذه الورقة أوجه القصور في الأساليب الحالية ذات الفضاءات المتقطعة من خلال اقتراح TraCS، وهو إطار عمل مبتكر لجمع بيانات المسار تحت نظام الخصوصية التفاضلية المحلية في الفضاءات المستمرة، والذي يوفر ضمانات للخصوصية والمنفعة مستقلة عن حجم فضاء الموقع مع التفوق على الأساليب الأحدث حالياً.

Ye Zheng, Yidan Hu2026-03-03
🤖 AI

Self-Destructive Language Model

تقدم الورقة البحثية SEAM، وهي آلية دفاع مبتكرة تعزز أمن النماذج اللغوية الكبيرة من خلال تدريب النماذج على الحفاظ على الأداء المشروع مع إظهار تدمير ذاتي كارثي عند تعرضها لهجمات الضبط الدقيق الضارة، مما يؤدي فعلياً إلى تحييد المحاولات العدائية لتقويض ضوابط السلامة.

Yuhui Wang, Rongyi Zhu, Ting Wang2026-03-03