💻 computer science

LLM-Assisted Detection and Repair of Hardware Security Vulnerabilities in Verilog Designs

تقترح هذه الورقة وتقيم منهجية تسخر النماذج اللغوية الكبيرة (LLMs) للكشف التلقائي والمساعدة في إصلاح الثغرات الأمنية في الأجهزة، وتحديداً نقاط الضعف الشائعة (CWEs)، ضمن تصميمات "Verilog" للتخفيف من المخاطر التي يصعب معالجتها بعد التصنيع.

Ethen Santana, Gabriel Gyaase, Hao Zheng2026-08-06
💻 computer science

Private Direct Preference Optimization for LLM Alignment

تقدم هذه الورقة بحثًا حول PrivDPO، وهي طريقة مبتكرة للتحسين المباشر للتفضيلات (Direct Preference Optimization) تفرض ضمانًا متخصصًا لـ "خصوصية التفضيل" عبر إضافة ضجيج مُعاير فقط على طول محور التفضيل أحادي البعد، مما يحقق توازنًا قويًا بين الخصوصية والمنفعة لمحاذاة النماذج اللغوية الكبيرة دون التحيزات التي تفرضها أساليب الخصوصية الجاهزة.

Yangfan Jiang, Fei Wei, Ergute Bao, Xiaokui Xiao, Yaliang Li, Bolin Ding2026-08-06
💻 computer science

Agent Against Agent: An Agentic System for Automatic Prompt Injection Red Teaming

تقدم الورقة البحثية PIMiner، وهو نظام وكيل (agentic system) يبني مكتبة استراتيجيات قابلة للنقل أثناء التدريب لتحقيق اختبار اختراق للنماذج اللغوية الكبيرة (red-teaming) عبر حقن الأوامر (prompt injection) بفعالية عالية وعدد استعلامات منخفض ضد النماذج المستهدفة غير المرئية، متفوقاً بشكل كبير على الأساليب الحالية القائمة على التعلم التعزيزي.

Yanting Wang, Chenlong Yin, Runpeng Geng, Jinyuan Jia2026-08-06
💻 computer science

GraphQLer: Enhancing GraphQL Security with Context-Aware API Testing

يُعد GraphQLer إطار عمل مفتوح المصدر لاختبار الأمن المؤتمت يعزز أمن واجهات برمجة تطبيقات GraphQL عبر بناء رسوم بيانية للتبعية محددة النوع من المخططات الحية لتخليق سلاسل ثغرات متعددة الخطوات، متفوقاً بذلك على الأدوات الحالية مثل ZAP وEvoMaster في اكتشاف العيوب المعقدة والاعتمادية على الحالة مثل تجاوز الصلاحيات (IDOR)، واستخدام الذاكرة بعد التحرير (UAF)، وثغرات الحقن.

Omar Tsai, Jianing Li, Tsz Tung Cheung, Lejing Huang, Hao Zhu, Jianrui Xiao, Iman Sharafaldin, Mohammad A. Tayebi2026-08-05
💻 computer science

A Unified Framework for Human AI Collaboration in Security Operations Centers with Trusted Autonomy

تقترح هذه الورقة إطاراً مبتكراً ومتعدد المستويات للتعاون بين الإنسان والذكاء الاصطناعي في مراكز عمليات الأمن، يقوم بربط خمسة مستويات من استقلالية الذكاء الاصطناعي ديناميكياً بأدوار محددة للعنصر البشري في الحلقة وعتبات الثقة، مما يتيح اتخاذ قرارات تكيفية وقابلة للتفسير تعزز الإشراف البشري بدلاً من استبداله في الدفاع السيبراني.

Ahmad Mohsin, Helge Janicke, Ahmed Ibrahim, Iqbal H. Sarker, Seyit Camtepe2026-08-05
💻 computer science

RoguePrompt: Dual-Layer Ciphering for Self-Reconstruction to Circumvent LLM Moderation

تقدم هذه الورقة RoguePrompt، وهو مسار آلي لكسر الحماية يستخدم التشفير ثنائي الطبقات (ROT-13 وVigenère) مقترناً بتعليمات فك التشفير باللغة الطبيعية لتحويل المطالبات المحظورة إلى استعلامات تبدو حميدة، محققاً معدلات نجاح عالية في تجاوز فلاتر السلامة وإعادة بناء النوايا الخبيثة عبر نماذج لغوية كبيرة متعددة رائدة.

Benyamin Tafreshian2026-08-05
💬 NLP

Geometry-Aware Localized Watermarking for Copyright Protection in Embedding-as-a-Service

تقترح الورقة البحثية GeoMark، وهو إطار عمل للعلامات المائية المحلية المدركة للهندسة لخدمة التضمين كخدمة (Embedding-as-a-Service)، والذي يحل مقايضة المتانة والمنفعة والقابلية للتحقق من خلال فصل التفعيل المحلي عن الإسناد المركزي لضمان حماية حقوق الطبع والنشر ضد الهجمات المختلفة مع الحفاظ على المنفعة اللاحقة.

Zhimin Chen, Xiaojie Liang, Wenbo Xu, Yuxuan Liu, Wei Lu2026-08-05
💻 computer science

The Rise and Fall of Google's Privacy Sandbox

تقدم هذه الورقة أول قياس طولي ومراعٍ للموافقة لـ "Google's Privacy Sandbox"، كاشفةً أن واجهات برمجة التطبيقات الخاصة بها عانت من ركود في التبني ودعم محدود من المنظومة التقنية قبل وقت طويل من موعد تقاعدها المعلن في أكتوبر ٢٠٢٥، مما ترك في نهاية المطاف تحدي الإعلانات القائمة على الاهتمامات مع الحفاظ على الخصوصية دون حل.

Rachid Youssef Grib, Alberto Verna, Nikhil Jha, Martino Trevisan, Marco Mellia2026-08-05
💻 computer science

Your Agentic LLMs Secretly Encode Latent Signals of Indirect Prompt-Injection Exposure

تُثبت هذه الورقة أن النماذج اللغوية الكبيرة الوكيلّة (agentic LLMs) تُشفّر بطبيعتها إشارات كامنة قابلة للكشف للتعرض لحقن الأوامر غير المباشر في حالاتها الخفية، والتي يمكن استغلالها لبناء دفاع قوي قائم على المسبار (AGRI) يعمل بفعالية على تحييد الهجمات مع الحفاظ على فائدة المهام.

Jianshuo Dong, Yiming Liu, Maosen Zhang, Nan Deng, Xu Peng, Xiaoping Zhang, Tianwei Zhang, Jie Zhang, Han Qiu2026-08-05
💻 computer science

Single Canonical Prompts Underestimate LLM Safety's Surface-Form Sensitivity

تُثبت هذه الورقة أن الاعتماد على مطالبات نموذجية (canonical prompts) واحدة لتقييم سلامة النماذج اللغوية الكبيرة يؤدي إلى تقدير نقص كبير في الامتثال غير الآمن، حيث تكشف التغييرات في الصيغ السطحية التي تحافظ على المعنى أن جزءاً كبيراً من السلوكيات الضارة يظل غير مكتشف بواسطة طرق القياس المعيارية.

Yongxi Zhou, Junwei Yao, Yuanzhe Liu, Zihan Dong, Wenbo Ye, Jiaxi Wen, Lai Yun Choi2026-08-05