🤖 machine learning

Low Rank Adaptation for Adversarial Perturbation

تُثبت هذه الورقة أن الاضطرابات العدائية تمتلك بنية ذات رتبة منخفضة متأصلة، وتستغل هذه الخاصية لتطوير طريقة هجوم "الصندوق الأسود" أكثر كفاءة وفعالية من خلال حصر البحث عن الاضطراب في فضاء فرعي منخفض الأبعاد.

Han Liu, Shanghao Shi, Yevgeniy Vorobeychik, Chongjie Zhang, Ning Zhang2026-05-01
💻 computer science

SST-Guard: Detecting and Characterizing Server-Side Google Analytics in the Wild

يقدم هذا البحث SST-Guard، وهو نظام متعدد الوسائط يعتمد على المتصفح يكتشف ويحظر "Google Analytics" من جانب الخادم عبر تحديد الآثار الدلالية لجمع البيانات عبر طلبات الشبكة، وملفات تعريف الارتباط، وكائن النافذة (window object)، متجاوزاً بذلك قيود طرق الحظر التقليدية عند الأطراف النهائية في مواجهة ممارسات التتبع الويب المتغيرة.

Muhammad Jazlan, Alexander Gamero-Garrido, Zubair Shafiq, Yash Vekaria2026-05-01
💻 computer science

SBN Explorer: An Empirical Study of Cryptographic Boolean Networks

تُصنف هذه الورقة الفضاء التصميمي للأنظمة البولينية التشفيرية إلى 64 فئة معمارية متميزة بناءً على ستة قيود هيكلية، وتقيم بشكل منهجي مقاومتها للهجمات التفاضلية والخطية والجبرية، كاشفةً أن الأمن الأمثل ينشأ من تركيبات محددة ومتفرقة من هذه القيود.

Arnaud Valence2026-05-01
💻 computer science

Variational and Majorization Principles in Lattice Reduction

تستخدم هذه الورقة نظرية الترتيب المهيمن لتوصيف تبديلات لوفازز (Lovász swaps) كتحويلات-T تعمل على تنعيم ملف غرام-شميت (Gram-Schmidt profile)، مما يوفر تفسيراً تغايرياً لغلاف تحليل الحساسية العالمية (GSA envelope) في الحالة الأسوأ، ويسمح بتطوير خوارزميات استدلالية للتضمين العميق التكيفي تعمل على تحسين كفاءة التبديل عبر هياكل الشبكات المتنوعة.

Javier Blanco-Romero, Florina Almenares Mendoza2026-05-01
💻 computer science

MASCing: Configurable Mixture-of-Experts Behavior via Activation Steering Masks

تُعد MASCing إطار عمل خفيف الوزن ولا يتطلب إعادة تدريب، يقوم بتهيئة نماذج خليط الخبراء (MoE) لسيناريوهات سلامة متنوعة عبر استخدام بديل يعتمد على شبكة LSTM لتحسين أقنعة التوجيه على بوابات التوجيه، مما يتيح تعزيز أو كبح سلوكيات محددة بشكل مستهدف دون المساس بالمنفعة العامة.

Jona te Lintelo, Lichao Wu, Marina Krček, Sengim Karayalçin, Stjepan Picek2026-05-01
💬 NLP

TwinGate: Stateful Defense against Decompositional Jailbreaks in Untraceable Traffic via Asymmetric Contrastive Learning

يُعد TwinGate إطار عمل دفاعي يعتمد على الحالة ويتميز بزمن انتقال منخفض، حيث يستخدم التعلم التبايني غير المتماثل للكشف بفعالية عن عمليات كسر الحماية التفكيكية في حركة مرور النماذج اللغوية الكبيرة غير القابلة للتتبع عبر تجميع شظايا النوايا الخبيثة مع كبح الإيجابيات الكاذبة، متفوقاً بذلك على النماذج المرجعية الحالية في مجموعة بيانات ضخمة تم إنشاؤها حديثاً تضم أكثر من 3.6 مليون تعليمات.

Bowen Sun, Chaozhuo Li, Yaodong Yang, Yiwei Wang, Chaowei Xiao2026-05-01
💻 computer science

FlashRT: Towards Computationally and Memory Efficient Red-Teaming for Prompt Injection and Knowledge Corruption

تقدم هذه الورقة FlashRT، وهو إطار عمل مبتكر يعزز بشكل كبير كفاءة الحوسبة والذاكرة لعمليات الاختبار الأحمر القائمة على التحسين للنماذج اللغوية الكبيرة ذات السياق الطويل، مما يتيح تقييمات أمنية أسرع وأكثر سهولة ضد هجمات حقن الأوامر وفساد المعرفة.

Yanting Wang, Chenlong Yin, Ying Chen, Jinyuan Jia2026-05-01
💻 computer science

Improved Bounds for Coin Flipping, Leader Election, and Random Selection

تضع هذه الورقة حدوداً محسنة لعمليات تقليب العملة، وانتخاب القائد، والاختيار العشوائي في نموذج المعلومات الكاملة من خلال إثبات أن البروتوكولات المكونة من kk جولة تتطلب على الأقل log\log^* \ell من الجولات لتحمل كسر خطي من اللاعبين السيئين، ومن خلال تقديم أول بروتوكول اختيار عشوائي من جولة واحدة مثالي يكون صامداً أمام O(/m)O(\ell/m) من الخصوم.

Eshan Chattopadhyay, Mohit Gurumukhani, Noam Ringach, Rocco A. Servedio2026-04-30
💬 NLP

One Word at a Time: Incremental Completion Decomposition Breaks LLM Safety

تقدم هذه الورقة البحثية "تفكيك الإكمال التدريجي" (ICD)، وهي استراتيجية اختراق جديدة تستدرج محتوى ضاراً من خلال استمراريات الكلمة الواحدة لتجاوز آليات السلامة في النماذج اللغوية الكبيرة بشكل منهجي، محققةً معدلات نجاح هجوم أعلى عبر معايير متعددة مع إثبات أن مثل هذه المسارات تثبط التمثيلات العصبية المتعلقة بالرفض.

Samee Arif, Naihao Deng, Zhijing Jin, Rada Mihalcea2026-04-30
💻 computer science

A Quantitative Confirmation of the Currier Language Distinction

تقدم هذه الورقة أدلة كمية تدعم صحة تمييز كوريير بين لغتي A و B في مخطوطة فوينيتش، وذلك من خلال إثبات أن نموذج مزيج بيتا-بينوميال يمكنه استعادة هذا الانقسام دون تسميات مسبقة، وأن مصنفًا خاضعًا للإشراف يمكنه التنبؤ بهويات الأوراق بدقة بلغت 89.2%.

Christophe Parisel2026-04-30