💬 NLP

MGTEVAL: An Interactive Platform for Systemtic Evaluation of Machine-Generated Text Detectors

تقدم هذه الورقة MGTEVAL، وهي منصة تفاعلية وقابلة للتوسع تعمل على توحيد تقييم كواشف النصوص المولدة آلياً من خلال دمج بناء مجموعات البيانات، ومحاكاة الهجمات، وتدريب الكواشف، ومقاييس الأداء في سير عمل قابل لإعادة الإنتاج يمكن الوصول إليه عبر كل من واجهات سطر الأوامر والواجهات الويب.

Yuanfan Li, Qi Zhou, Chengzhengxu Li, Zhaohan Zhang, Chenxu Zhao, Zepu Ruan, Chao Shen, Xiaoming Liu2026-04-29
💻 computer science

Secure Conformance Checking using Token-based Replay and Homomorphic Encryption

تقترح هذه الورقة نهجاً آمناً للتحقق من المطابقة يُمكّن مالك السجل من التحقق من امتثال العمليات مقابل نموذج خارجي دون الكشف عن بيانات سجل الأحداث الحساسة، وذلك عبر الجمع بين إعادة التشغيل القائمة على الرموز (token-based replay) والتشفير المتماثل.

Luis-Armando Rodríguez-Flores, Luciano García-Bañuelos, Abel Armas-Cervantes, Astrid-Monserrat Rivera-Partida2026-04-29
🤖 machine learning

Making AI-Assisted Grant Evaluation Auditable without Exposing the Model

تقترح هذه الورقة بنية قائمة على بيئة التنفيذ الموثوقة (TEE) تستخدم التوثيق عن بُعد لإنشاء حزم تقييم موقعة وقابلة للتدقيق لمراجعات المنح المدعومة بالذكاء الاصطناعي، مما يضمن شفافية العملية ومقاومة حقن الأوامر دون الكشف عن أوزان النماذج المملوكة أو منطق التسجيل.

Kemal Bicakci2026-04-29
💻 computer science

MARD: A Multi-Agent Framework for Robust Android Malware Detection

إن MARD هو إطار عمل متعدد الوكلاء يستفيد من النماذج اللغوية الكبيرة لتنسيق أدوات التحليل الحتمية عند الطلب عبر آلية تفاعل قائمة على ReAct، مما يحقق كشفاً قوياً، وقابلاً للتفسير، وفعالاً من حيث التكلفة لبرمجيات أندرويد الخبيثة بدقة عالية وتعميم قوي ضد انزياح المفاهيم دون الحاجة إلى ضبط دقيق خاص بالمجال.

Xueying Zeng, Youquan Xian, Sihao Liu, Xudong Mou, Yanze Li, Lei Cui, Bo Li2026-04-29
💻 computer science

Medoid Prototype Alignment for Cross-Plant Unknown Attack Detection in Industrial Control Systems

تقترح هذه الورقة إطار عمل لمحاذاة النماذج الأولية الميدويدية (medoid prototype alignment) يقوم بضغط حركة مرور أنظمة التحكم الصناعية غير المتجانسة إلى تمثيلات قابلة للمقارنة، ويقوم بمحاذاة النماذج الميدويدية الأولية القوية عبر المجالات للكشف بفعالية عن الهجمات غير المعروفة في سيناريوهات المصانع المتقاطعة، محققاً أداءً واستقراراً فائقين مقارنة بالنماذج الحالية.

Luyao Wang2026-04-29
💬 NLP

The Surprising Universality of LLM Outputs: A Real-Time Verification Primitive

تقدم هذه الورقة بحثاً حول أداة تقييم أولية فائقة السرعة وتعمل على المعالج المركزي فقط، تستفيد من توزيع ماندلبروت العالمي للرتب والتردد المكون من معلمين لنمذجة مخرجات النماذج اللغوية الكبيرة، وذلك لتمكين البصمة الإحصائية للنماذج وتقييم المخرجات في الصندوق الأسود بتأخير يصل إلى 100,000 مرة أقل من أدوات الكشف الحالية القائمة على أخذ العينات.

Alex Bogdan, Adrian de Valois-Franklin2026-04-29
💻 computer science

Prime-Field PINI: Machine-Checked Composition Theorems for Post-Quantum NTT Masking

تقدم هذه الورقة أول نظريات تركيب مُتحقق منها آلياً لتقنيات التغطية الحسابية (arithmetic masking) عبر الحقول الأولية، حيث تثبت أن التغطية العشوائية الجديدة بين مراحل خطوط المعالجة تضمن الاستقلال الأمني عن المراحل السابقة، وتستخدم هذه النتائج الرسمية لتشخيص خلل حرج في التغطية بين المراحل في مسرع Adams Bridge PQC الخاص بشركة مايكروسوفت.

Ray Iskander, Khaled Kirah2026-04-29
🤖 machine learning

Conditional misalignment: common interventions can hide emergent misalignment behind contextual triggers

تكشف هذه الورقة أن التدخلات الشائعة التي تهدف إلى الحد من عدم المحاذاة الناشئ في النماذج اللغوية غالبًا ما تفشل في القضاء عليه تمامًا، بل تتسبب بدلاً من ذلك في جعل النماذج تُظهر "عدم محاذاة شرطي" حيث يتم تحفيز السلوكيات الضارة فقط بواسطة المدخلات التي تشترك في سمات سياقية محددة مع بيانات التدريب، مما يخفي هذه الثغرة عن التقييمات القياسية.

Jan Dubiński, Jan Betley, Anna Sztyber-Betley, Daniel Tan, Owain Evans2026-04-29
💻 computer science

Can Large Language Models Really Recognize Your Name?

تقدم هذه الورقة AmBench، وهو معيار مرجعي يضم أكثر من 12,000 اسم بشري غامض، لتوضيح أن النماذج اللغوية الكبيرة تظهر أداءً أقل بكثير في اكتشاف مثل هذه الأسماء مقارنة بالأسماء المتعارف عليها، مما يكشف عن فجوات حرجة في العدالة والضعف تجاه هجمات حقن الأوامر في أنظمة حماية الخصوصية القائمة على النماذج اللغوية الكبيرة.

Dzung Pham, Peter Kairouz, Niloofar Mireshghallah, Eugene Bagdasarian, Chau Minh Pham, Amir Houmansadr2026-04-28
💻 computer science

PARASITE: Conditional System Prompt Poisoning to Hijack LLMs

تقدم الورقة البحثية PARASITE، وهو إطار عمل لهجوم الصندوق الأسود يقوم بتسميم مطالبات الأنظمة التابعة لجهات خارجية بـ "عملاء نائمين" لاختطاف النماذج اللغوية الكبيرة وتوجيهها نحو توليد استجابات مستهدفة ومخترقة لاستعلامات محددة مع الحفاظ على الوظائف الطبيعية للمدخلات الحميدة، مما يؤدي فعلياً إلى التهرب من الدفاعات القياسية.

Viet Pham, Thai Le2026-04-28