🤖 machine learning

A Comprehensive Evaluation of Code Language Models for Security Patch Detection

تقدم هذه الورقة إعادة تقييم صارمة لنماذج لغة الأكواد البرمجية للكشف عن التعديلات (commits) الخاصة بإصلاح الثغرات الأمنية باستخدام إطار عمل موحد يضم 20 مجموعة بيانات و270 نموذجاً، كاشفةً أن النماذج الحالية تعاني من تسرب البيانات وأخطاء في التصنيف، وتفشل في النهاية في تحديد الإصلاحات الأمنية بشكل موثوق تحت قيود صارمة لنسبة الإيجابيات الكاذبة.

Nils Loose, Joseph Bienhüls, Kristoffer Hempel, Felix Mächtle, Thomas Eisenbarth2026-08-06
🤖 AI

Security in the Fine-Tuning Lifecycle of Large Language Models: Threats, Defenses,Evaluation, and Future Directions

تقدم هذه الورقة مسحاً منهجياً وتقييماً تجريبياً موحداً للتهديدات والدفاعات الأمنية عبر دورة حياة الضبط الدقيق الكاملة للنماذج اللغوية الكبيرة، كاشفةً أن فعالية الهجوم تعتمد بشكل كبير على النموذج وأن الدفاعات أحادية المرحلة نادراً ما تكون قابلة للتعميم، مما يحدد المشكلات المفتوحة الرئيسية والاتجاهات البحثية المستقبلية.

Wenjuan Li, Yitao Liu, Runze Chen, Rajkumar Buyya2026-08-06
🧬 biology

GENEB: Why Genomic Models Are Hard to Compare

لمعالجة صعوبة مقارنة النماذج التأسيسية الجينومية بسبب تشتت المعايير المرجعية وعدم توافق البروتوكولات، تقدم الورقة البحثية GENEB، وهو معيار تشخيصي موحد واسع النطاق يقيم 40 نموذجاً عبر 100 مهمة للكشف عن عدم استقرار التصنيفات الإجمالية وإثبات أن التوافق في البنية والتدريب المسبق غالباً ما يفوق أهمية حجم النموذج.

Daria Ledneva, Mikhail Nuridinov, Denis Kuznetsov2026-08-06
📊 statistics

Cautious optimism for deep parameterized quantum circuits

تُثبت هذه الورقة، من خلال البراهين التحليلية والتجارب العددية، أن الدوائر الكمومية ذات المعلمات القائمة على التدرج يمكن أن تُظهر تحسناً في التعميم على البيانات غير المرئية مع زيادة حجم النموذج، مُظهرةً ظاهرة "النزول المزدوج" التي تتحدى الرؤية التقليدية بأن النماذج الأكبر تؤدي إلى تدهور الأداء، وتُقدم تفاؤلاً حذراً لمستقبل تعلم الآلة الكمومي العميق.

Marie Kempkes, Elies Gil-Fuster, Carlos Bravo-Prieto, Aroosa Ijaz, Alissa Wilms, Jens Eisert, Evert van Nieuwenburg, Ved (…)2026-08-06
🤖 machine learning

C2^2MOE: Consistency and Complementarity-guided Mixture of Experts for Incomplete Multimodal Emotion Learning

تقترح هذه الورقة البحثية إطار عمل C2^2MOE، وهو إطار عمل مبتكر يعالج تحدي فقدان الأنماط في التعرف على العواطف متعدد الوسائط من خلال توحيد تعلم التمثيل والاستكمال عبر بنية "خليط من الخبراء" (Mixture of Experts) التي تعمل على نمذجة واستغلال كل من الاتساق والتكامل عبر الوسائط بشكل صريح.

Yuntao Shou, Tao Meng, Wei Ai, Keqin Li2026-08-06
🤖 machine learning

On Hamming-Lipschitz Type Stability of the Subdominant (Minmax) Ultrametric: Theory and Simple Proofs

تؤسس هذه الورقة نظرية استقرار من نوع 0\ell_0 للمتري فوق المتر (ultrametric) دون المهيمن، مبرهنةً على أن الاضطرابات المتفرقة في مصفوفة عدم التشابه تنتقل عبر شجرة الامتداد الدنيا لتغير مدخلات المتري فوق المتر بطريقة محكومة بدرجات هامينج-ليبشيتز (Hamming-Lipschitz) تعتمد على هندسة الشجرة والتعرض للقطع.

Alokendu Mazumder, Arnab Roy, Punit Rathore2026-08-06
📊 statistics

AI-driven Multimodal Representation Learning for Latent Mediation Structure Discovery of Socioeconomic Disadvantage, Psychosocial Factors, and Cardiometabolic Multimorbidity: Insights from the All of Us Research Program

باستخدام إطار عمل متعدد الوسائط مدفوع بالذكاء الاصطناعي على بيانات من برنامج "All of Us" البحثي، تكشف هذه الدراسة أن الهشاشة النفسية والاجتماعية تعمل كوسيط كامن حاسم يربط بين الحرمان الاجتماعي والاقتصادي وتعدد الأمراض الأيضية القلبية الوعائية.

Cong Cao, Shuangge Ma2026-08-06
🤖 machine learning

When More Becomes Less: Position-Dependent Repetition Effects in Language Models

تُظهر هذه الورقة أن تأثير تكرار الرموز (tokens) على تنبؤات النماذج اللغوية يعتمد على الموضع، مما يكشف أنه في حين أن التكرار المتجاور يعزز احتمالية الهدف باستمرار، فإن التكرار المزاح يُنتج تأثيراً على شكل حرف "U" مقلوب حيث تبلغ الاحتمالية ذروتها ثم تنخفض مع زيادة التكرار، مما يتحدى الافتراض بأن تأثيرات التكرار موحدة بغض النظر عن موضع القراءة.

Han-yu Wang2026-08-06
📊 statistics

A Multi-Cohort Validation of Censoring-Aware Conformal Lower Predictive Bounds for Pathology Survival Models

تقيم هذه الورقة غلافاً توافقياً لاحقاً (drcosarc) لنماذج البقاء في علم الأمراض عبر مجموعات متعددة من بيانات TCGA وCPTAC، مظهرةً أنه في حين يحقق تغطية قريبة من الاسمية في حالات الرقابة المنخفضة ويحسن الحدود التنبؤية الدنيا في أنواع معينة من السرطان، إلا أن أداءه يظل معتمداً بشكل كبير على خصائص المجموعة، وطرق التجميع على مستوى المريض، وافتراضات الرقابة.

Mingi Hong2026-08-06
🤖 machine learning

A Trust-region Framework for Moment Estimation

تقدم هذه الورقة البحثية \textsc{Gmake}، وهو إطار عمل لمنطقة الثقة يوحد آليات تقدير العزم التكيفية مثل Adam من خلال تقييد خطوات التحديث عبر معايير قائمة على العزوم، كاشفةً أنه في حين يتفوق تقدير العزم الرابع (الشبه تفرطحي) في ظل القيود الضعيفة، فإن تقدير العزم الثاني يصبح تنافسياً بشكل متزايد مع اشتداد ضوابط منطقة الثقة.

Oluwasegun A. Somefun2026-08-06