💻 computer science

How Vulnerable Are AI Agents to Indirect Prompt Injections? Insights from a Large-Scale Public Competition

تقدم هذه الورقة نتائج من مسابقة واسعة النطاق لاختبار الاختراق (red teaming) تُظهر أن جميع نماذج الذكاء الاصطناعي الرائدة التي تم تقييمها عرضة لهجمات حقن الأوامر غير المباشرة والمخفية، مما يكشف أن القدرة العالية للنموذج لا ترتبط بزيادة المتانة ويسلط الض|ء على نقاط ضعف جوهرية في بنيات اتباع التعليمات الحالية.

Mateusz Dziemian, Maxwell Lin, Xiaohan Fu, Micha Nowak, Nick Winter, Eliot Jones, Andy Zou, Lama Ahmad, Kamalika Chaudhu (…)2026-03-18
💻 computer science

Grant, Verify, Revoke: A User-Centric Pattern for Blockchain Compliance

تقدم هذه الورقة البحثية إطار عمل "ZK-Compliance"، وهو إطار عمل متمحور حول المستخدم يستفيد من براهين المعرفة الصفرية لتمكين الإفصاح الانتقائي عن سمات الهوية لأغراض الامتثال التنظيمي لسلاسل الكتل، مما يسمح للمستخدمين بالتحقق من الأهلية دون ربط هوياتهم في العالم الحقيقي بسجلات معاملاتهم العامة بشكل دائم.

Supriya Khadka, Sanchari Das2026-03-18
💻 computer science

ClawWorm: Self-Propagating Attacks Across LLM Agent Ecosystems

تقدم هذه الورقة ClawWorm، وهو أول هجوم دودة ذاتية الانتشار يستهدف أنظمة الوكلاء القائمة على النماذج اللغوية الكبيرة (LLM) ذات النطاق الإنتاجي مثل OpenClaw، والذي يقوم باختطاف الإعدادات بشكل مستقل لضمان الاستمرارية والانتشار عبر شبكات الوكلاء المتعددين دون أي تدخل إضافي من المهاجم.

Yihao Zhang, Zeming Wei, Xiaokun Luan, Chengcan Wu, Zhixin Zhang, Jiangrong Wu, Haolin Wu, Huanran Chen, Jun Sun, Meng S (…)2026-03-18
💻 computer science

Do Not Leave a Gap: Hallucination-Free Object Concealment in Vision-Language Models

تقدم هذه الورقة هجوماً لإخفاء الأجسام خالياً من الهلوسة لنماذج الرؤية واللغة، حيث يقوم بإخفاء الأجسام المستهدفة عن طريق إعادة ترميزها لتكون متسقة دلالياً مع الخلفية، مما يتجنب الفجوات التمثيلية التي تسبب عادةً هلوسة النماذج.

Amira Guesmi, Muhammad Shafique2026-03-18
💬 NLP

Resource Consumption Threats in Large Language Models

تستعرض هذه الدراسة المسحية بشكل منهجي تهديدات استهلاك الموارد في النماذج اللغوية الكبيرة، مقدمةً إطاراً موحداً يمتد من استحثاث التهديد وفهم الآليات إلى استراتيجيات التخفيف لمعالجة تحديات الكفاءة الحسابية والاستدامة الاقتصادية.

Yuanhe Zhang, Xinyue Wang, Zhican Chen, Weiliu Wang, Zilu Zhang, Zhengshuo Gong, Zhenhong Zhou, Li Sun, Yang Liu, Sen Su2026-03-18
💻 computer science

Ciphertext-Policy ABE for NC1\mathsf{NC}^1 Circuits with Constant-Size Ciphertexts from Succinct LWE

تقدم هذه الورقة مخطط تشفير قائم على السمات بأسلوب سياسة التشفير، وهو آمن انتقائياً وقائم على الشبكات (lattice-based) لدوائر NC1\mathsf{NC}^1، ويحقق نصوصاً مشفرة ومفاتيح عامة ذات حجم ثابت لا يعتمد على عمق الدائرة تحت فرضية LWE الموجزة.

Jiaqi Liu, Yuanyi Zhang, Fang-Wei Fu2026-03-18
💻 computer science

KidsNanny: A Two-Stage Multimodal Content Moderation Pipeline Integrating Visual Classification, Object Detection, OCR, and Contextual Reasoning for Child Safety

يُعد KidsNanny نظاماً ثنائي المراحل ومنخفض التأخير للإشراف على المحتوى متعدد الوسائط، يجمع بين الفحص البصري السريع والاستدلال السياقي القائم على النصوص لتحقيق دقة وسرعة فائقتين في اكتشاف تهديدات سلامة الأطفال مقارنة بالنماذج الحالية، ويتميز بشكل خاص في تحديد المخاطر المضمنة في النصوص.

Viraj Panchal, Tanmay Talsaniya, Parag Patel, Meet Patel2026-03-18
💻 computer science

Systematization of Knowledge: The Design Space of Digital Payment Systems with Potential for CBDC

تقدم هذه الورقة تحليلاً تقنياً منهجياً لـ 36 تصميماً لأنظمة الدفع الرقمي لتحديد الأنماط المتكررة، والمقايضات، وتحديات التنفيذ، بهدف توجيه تطوير العملات الرقمية للبنوك المركزية (CBDCs) القابلة للتوسع والآمنة، مع تسليط الضوء على الفجوات البحثية الحرجة في المدفوعات غير المتصلة بالإنترنت والأمن لما بعد الحوسبة الكمومية.

Judith Senn, Aljosha Judmayer, Nicholas Stifter, Rainer Böhme2026-03-18
🤖 AI

Detecting Sentiment Steering Attacks on RAG-enabled Large Language Models

تقدم هذه الورقة نظامي كشف تسلل قائمين على التعلم العميق وخفيفي الوزن، باستخدام بنيتي CNN وLSTM، واللذين يحققان دقة عالية في تحديد وتصنيف التهديدات السيبرانية داخل شبكات إنترنت الأشياء باستخدام مجموعة بيانات CICIoT2023.

Isha Andrade, Shalaka S Mahadik, Mithun Mukherjee, Pranav M Pawar, Raja Muthalagu2026-03-18
💻 computer science

Poisoning the Pixels: Revisiting Backdoor Attacks on Semantic Segmentation

تقدم هذه الورقة البحثية BADSEG، وهو إطار عمل موحد يصنف وينفذ بشكل منهجي هجمات الباب الخلفي المتنوعة على نماذج التجزئة الدلالية، مما يثبت فعاليتها العالية عبر مختلف البنيات —بما في ذلك المحولات (transformers) ونموذج SAM— مع كشف عدم كفاية آليات الدفاع الحالية.

Guangsheng Zhang, Huan Tian, Leo Zhang, Tianqing Zhu, Ming Ding, Wanlei Zhou, Bo Liu2026-03-18