💻 computer science

PRISM: Robust VLM Alignment with Principled Reasoning for Integrated Safety in Multimodality

تقدم الورقة البحثية PRISM، وهو إطار عمل شبيه بالنظام 2 (System 2) يعزز سلامة نماذج الرؤية واللغة من خلال عملية استدلال مكونة من أربع مراحل مهيكلة، وتحسين "التحسين المباشر للتفضيلات" (Direct Preference Optimization) عبر بحث شجرة مونت كارلو (MCTS)، مما يقلل بفعالية من معدلات نجاح الهجمات مع الحفاظ على فائدة النموذج ضد التهديدات متعددة الوسائط المعقدة.

Nanxi Li, Zhengyue Zhao, G. Edward Suh, Marco Pavone, Chaowei Xiao2026-04-03
💻 computer science

Differential Privacy for Secure Machine Learning in Healthcare IoT-Cloud Systems

تقترح هذه الورقة بنية تحتية آمنة متعددة الطبقات من إنترنت الأشياء والحافة والسحابة (IoT-Edge-Cloud) للرعاية الصحية، تدمج الخصوصية التفاضلية مع آلية ضوضاء هجينة بين "لابلاس" و"غاوس" وتقنية "البلوكشين" لحماية بيانات المرضى مع الحفاظ على دقة عالية لتعلم الآلة وتقليل زمن استجابة الطوارئ بشكل كبير.

N Mangala, Murtaza Rangwala, S Aishwarya, B Eswara Reddy, Rajkumar Buyya, KR Venugopal, SS Iyengar, LM Patnaik2026-04-03
💻 computer science

UniMark: Artificial Intelligence Generated Content Identification Toolkit

يُعد UniMark إطار عمل موحداً ومفتوح المصدر يعالج التجزئة في مجال تحديد محتوى الذكاء الاصطناعي من خلال دمج محرك معياري للتحليل متعدد الوسائط مع استراتيجية مبتكرة ثنائية التشغيل تدعم كلاً من العلامات المائية الخفية والعلامات التنظيمية المرئية، إلى جانب معايير قياسية للتقييم الصارم للأداء.

Meilin Li, Ji He, Yi Yu, Jia Xu, Shanzhe Lei, Yan Teng, Yingchun Wang, Xuhong Wang2026-04-03
📊 statistics

Average-Case Reductions for kk-XOR and Tensor PCA

تؤسس هذه الورقة إطاراً شاملاً لعمليات الاختزال في المتوسط خلال وقت حدودي توحد بين مسألتي kk-XOR المزروعة المشوبة وPCA الموتر عبر مختلف رتب وكثافات الموترات، مما يحدد ترتيباً جزئياً للشدة ويسمح باختزال الحالات المفترض شدتها بين هذه المسائل النموذجية.

Guy Bresler, Alina Harbuzova2026-04-03
💻 computer science

Triosecuris: Formally Verified Protection Against Speculative Control-Flow Hijacking

تقدم هذه الورقة البحثية Triosecuris، وهي آلية دفاعية تم التحقق منها شكلياً تجمع بين حماية الأجهزة من نمط CET وحماية التحميل الاستباقي التي يدرجها المترجم لمنع هجمات Spectre من نوع BTB وRSB وPHT، مع برهان تم التحقق منه آلياً يضمن أن البرامج المحولة لا تسرب معلومات أكثر من نظيراتها المصدرية بغض النظر عن التنبؤ.

Jonathan Baumann, Yonghyun Kim, Yan Farba, Catalin Hritcu, Julay Leatherman-Brooks2026-04-03
💻 computer science

"The System Will Choose Security Over Humanity Every Time": Understanding Security and Privacy for U.S. Incarcerated Users

تكشف هذه الورقة، من خلال مقابلات مع أفراد قضوا عقوبات سابقة وعائلاتهم، كيف أن نشر الأجهزة الرقمية في السجون الأمريكية يعطي الأولوية للأمن والمراقبة على حساب خصوصية المستخدم واستقلاليته، مما يتسبب في أضرار اجتماعية وعلاقية جسيمة، وتدعو إلى التصميم الشامل والرقابة العامة لتحقيق توازن أفضل بين هذه المصالح المتضاربة.

Yael Eiger, Nino Migineishvili, Emi Yoshikawa, Liza Nadtochiy, Kentrell Owens, Franziska Roesner2026-04-03
💻 computer science

Preserving Target Distributions With Differentially Private Count Mechanisms

تقدم هذه الورقة إطار عمل جديداً من مرحلتين لآليات العد ذات الخصوصية التفاضلية التي تحافظ على التوزيعات المستهدفة من خلال الجمع بين مُخصِّص توزيع "لابلاس الدوري" الجديد وخوارزمية بناء فعالة تعتمد على نظرية "مقاييس إبسيلون"، مما يوازن بين دقة التوزيع، ودقة العد، وأداء وقت التشغيل.

Nitin Kohli, Paul Laskowski2026-04-03
💻 computer science

SelfGrader: Stable Jailbreak Detection for Large Language Models using Token-Level Logits

يُعد SelfGrader طريقةً خفيفة الوزن ومستقرة للكشف عن عمليات كسر الحماية (jailbreak) في النماذج اللغوية الكبيرة، حيث يستفيد من احتمالات الرموز (token-level logits) وقاعدة تسجيل ثنائية المنظور لتحقيق انخفاضات كبيرة في معدلات نجاح الهجمات مع تقليل استهلاك الذاكرة وزمن الاستجابة بشكل جذري مقارنة بحواجز الحماية الحالية.

Zikai Zhang, Rui Hu, Olivera Kotevska, Jiahao Xu2026-04-03
💻 computer science

Type-Checked Compliance: Deterministic Guardrails for Agentic Financial Systems Using Lean 4 Theorem Proving

تقدم هذه الورقة بروتوكول (Lean-Agent)، وهو نظام تحقق رسمي يستخدم إثبات النظريات عبر لغة (Lean 4) لضمان امتثال إجراءات الذكاء الاصطناعي المالي المستقل للمتطلبات التنظيمية الصارمة رياضياً، مما يستبدل الحواجز الوقائية الاحتمالية غير الكافية بسلامة حتمية وقابلة للتحقق تشفيراً.

Devakh Rashie, Veda Rashi2026-04-03
💻 computer science

AI-Assisted Hardware Security Verification: A Survey and AI Accelerator Case Study

تستعرض هذه الورقة الدور الناشئ للذكاء الاصطناعي والنماذج اللغوية الكبيرة في أتمتة التحقق من أمن الأجهزة عبر مراحل سير العمل الرئيسية، وتتحقق من تطبيقها العملي من خلال دراسة حالة على مسرع NVDLA، مع التأكيد على ضرورة إرساء المخرجات المولدة بواسطة الذكاء الاصطناًعي على أسس من المحاكاة الصارمة والاستدلال الرسمي لضمان ضمان أمني موثوق.

Khan Thamid Hasan, Md Ajoad Hasan, Nashmin Alam, Md. Touhidul Islam, Upoma Das, Farimah Farahmandi2026-04-03