🤖 machine learning

OverThink: Slowdown Attacks on Reasoning LLMs

تقدم الورقة البحثية "OverThink"، وهو هجوم مبتكر يستغل نماذج لغات الاستدلال عبر حقن مسائل وهمية معقدة وغير ضارة في المحتوى العام لإجبارها على توليد رموز (tokens) مفرط، مما يتسبب في زيادات كبيرة في زمن الاستجابة والتكلفة مع التهرب من فلاتر السلامة.

Abhinav Kumar, Jaechul Roh, Ali Naseh, Marzena Karpinska, Mohit Iyyer, Amir Houmansadr, Eugene Bagdasarian2026-02-05
📊 statistics

DP-SPRT: Differentially Private Sequential Probability Ratio Tests

تقدم هذه الورقة DP-SPRT، وهو غلاف للخصوصية التفاضلية لاختبار نسبة الاحتمال المتسلسل لـ Wald، والذي يستخدم آلية OutsideInterval مبتكرة لتحقيق تعقيد عينة قريب من المثالي وتحسين ضمانات الخصوصية مع التحكم بفعالية في احتمالات الخطأ تحت كل من إعدادات الخصوصية التفاضلية النقية وخصوصية ريني.

Thomas Michel, Debabrota Basu, Emilie Kaufmann2026-02-05
💻 computer science

Predicting Module-Lattice Reduction

تقدم هذه الورقة تحليلاً ملموساً لحالة المتوسط في اختزال الشبكة النمطية، حيث تُظهر أن مميز الحقل العددي الأساسي يقود كفاءة خوارزمية (module-BKZ) ويحقق تسريعاً تحت أسي مقارنة بخوارزمية (BK_Z) غير المهيكلة لمعظم الحقول السيكلوطومية، وهو اكتشاف تدعمه أول عملية تنفيذ مفتوحة المصدر لخوارزمية (module-BKZ).

Léo Ducas, Lynn Engelberts, Paola de Perthuis2026-02-05
💻 computer science

Defending Against Prompt Injection with DataFilter

تقدم الورقة البحثية DataFilter، وهو دفاع مستقل عن النموذج ويُستخدم في وقت الاختبار، يستخدم الضبط الدقيق الخاضع للإشراف لتجريد تعليمات حقن المطالبات الخبيثة انتقائياً من البيانات غير الموثوقة قبل وصولها إلى نموذج لغوي كبير، مما يحقق معدلات نجاح هجوم تقترب من الصفر مع الحفاظ على الفائدة وتمكين النشر الجاهز للتشغيل (plug-and-play) للأنظمة ذات الصندوق الأسود.

Yizhu Wang, Sizhe Chen, Raghad Alkhudair, Basel Alomair, David Wagner2026-02-05
🔢 mathematics

Three results on twisted GG-codes and skew twisted GG-codes

تحل هذه الورقة مسألة مفتوحة تتعلق بقابلية التحقق من أكواد المجموعة الملتوية، وتعمم نتيجة من خلال إثبات أن جميع المثالية ذات البعد-3 فوق جبرات المجموعات الملتوية هي أكواد مجموعات تبادلية، وتضع حداً للبعد والمسافة لأكواد المجموعات الملتوية مع تحديد شروط تحقيقه.

Alvaro Otero Sanchez2026-02-05
🤖 machine learning

Co-RedTeam: Orchestrated Security Discovery and Exploitation with LLM Agents

يُعد Co-RedTeam إطار عمل متعدد الوكلاء واعٍ أمنياً، يستفيد من النماذج اللغوية الكبيرة مع التفكير القائم على التنفيذ، والتفاعل المنظم، والذاكرة طويلة الأمد، ليتفوق بشكل كبير على النماذج المرجعية الحالية في الاكتشاف والاستغلال الآلي للثغرات الأمنية عبر محاكاة سير عمل فرق الفريق الأحمر في العالم الحقيقي.

Pengfei He, Ash Fox, Lesly Miculicich, Stefan Friedli, Daniel Fabian, Burak Gokturk, Jiliang Tang, Chen-Yu Lee, Tomas Pf (…)2026-02-05
📊 statistics

Privacy utility trade offs for parameter estimation in degree heterogeneous higher order networks

تضع هذه الورقة حدوداً دنيا لـ "مينيماكس" (minimax) في العينات المحدودة وتقترح مُقدِّرات مثالية لتقدير المعلمات في نماذج β\beta للشبكات ذات الدرجات غير المتجانسة تحت الخصوصية التفاضلية المحلية والمركزية، مما يوفر أول توصيف شامل للمقايضات بين الخصوصية والمنفعة لكل من الرسوم البيانية القياسية والرسوم البيانية الفائقة ذات الرتب العليا.

Bibhabasu Mandal, Sagnik Nandy2026-02-05
💻 computer science

Boost+: Equitable, Incentive-Compatible Block Building

تقترح هذه الورقة آلية +Boost، التي تفصل بين جمع المعاملات وترتيبها لضمان الوصول العادل والمزايدة الصادقة المتوافقة مع الحوافز لكل من البنائين والباحثين، مما يعالج قضايا المركزية والكفاءة التي تعاني منها منظومة MEV-Boost الحالية في إيثيريوم.

Mengqian Zhang, Sen Yang, Kartik Nayak, Fan Zhang2026-02-05
💻 computer science

Semantic Consensus Decoding: Backdoor Defense for Verilog Code Generation

تقترح هذه الورقة البحثية "فك التشفير بالتوافق الدلالي" (SCD)، وهو دفاع سلبي أثناء مرحلة الاستنتاج يخفف من هجمات الأبواب الخلفية في توليد أكواد Verilog عبر استغلال انحياز المهاجمين نحو المتطلبات غير الوظيفية للكشف عن المحفزات الخبيثة وقمعها، مما يقلل معدل نجاح الهجوم من 89% إلى أقل من 3% مع تأثير ضئيل للغاية على جودة التوليد.

Guang Yang, Xing Hu, Xiang Chen, Xin Xia2026-02-05