💻 computer science

Few-Shot Network Intrusion Detection Using Online Triplet Mining

تقترح هذه الورقة نظاماً لكشف التسلل في الشبكات يعتمد على التعلم بلقطات قليلة، يجمع بين شبكة ثلاثية مع تنقيب ثلاثي عبر الإنترنت ومصنف "أقرب جار" (KNN) لتحديد حركة المرور الضارة بفعالية باستخدام 10 عينات مصنفة فقط لكل فئة هجوم، مما يعالج أوجه القصور في طرق الكشف التقليدية القائمة على التعلم الخاضع للإشراف وكشف الشذوذ في سيناريوهات ندرة البيانات.

Jack Wilkie, Hanan Hindy, Christos Tachtatzis, Miroslav Bures, Robert Atkinson2026-05-19
💻 computer science

Evaluating Deep Research Agents on Expert Consulting Work: A Benchmark with Verifiers, Rubrics, and Cognitive Traps

تقدم هذه الورقة معياراً صارماً لتقييم وكلاء البحث العميق في مهام الاستشارات التخصصية باستخدام مطالبات صاغها خبراء موضوعيون تتضمن فخاخاً معرفية، مما يكشف أن النماذج الرائدة الحالية (Claude وo3 وGemini) تحقق معدلات قبول منخفضة بشكل موحد بسبب أنماط فشل متميزة مثل الهلوسة، والأخطاء الحسابية، وعدم اتساق الاستدلال.

Tanmay Asthana, Aman Saksena, Divyansh Sahu2026-05-19
📊 statistics

Controlling False Discovery in Arbitrarily Structured Hypothesis Spaces via Reproducing Kernels

تقدم هذه الورقة إطار عمل مبتكر للتحكم في معدل الاكتشاف الخاطئ في فضاءات فرضيات ذات بنى تعسفية، وذلك عبر إعادة صياغة المشكلة كمسألة تعلم منتظم ضمن فضاء هيلبرت لإعادة إنتاج النواة، مما يوحد البنى المتنوعة مثل الرسوم البيانية والتسلسلات الهرمية لتمكين استدلال سلس وفعال من حيث العينات مع ضمانات مثبتة لمعدل الاكتشاف الخاطئ.

Binyamin Perets, Shie Mannor2026-05-19
💻 computer science

Automated Root-Cause Subclassification and No-Code Fix Generation for Invalid Bug Reports

تقدم هذه الورقة تصنيفاً معيارياً لتصنيف تقارير الأخطاء البرمجية غير الصالحة إلى فئات فرعية، وتقيم نهجاً مختلفة للذكاء الاصطناعي، حيث وجدت أن التوليد المعزز بالاسترجاع يتفوق في تحديد السبب الجذري، بينما يعد البحث الويب الوكيل الأكثر فعالية في توليد إصلاحات قابلة للتنفيذ بدون كود.

Mahmut Furkan Gon, Emre Dinc, Tevfik Emre Sungur, Eray Tuzun2026-05-19
🤖 machine learning

Beyond Accuracy: Robustness, Interpretability and Expressiveness of EEG Foundation Models

تقدم هذه الدراسة أول تقييم معياري منهجي لستة نماذج تأسيسية لتخطيط كهربائية الدماغ (EEG) عبر ثماني مجموعات بيانات، كاشفةً أنه بينما تتوافق هذه النماذج عموماً مع الفسيولوجيا العصبية وتمتلك قدرة تمثيلية قوية، إلا أن أداءها حساس للغاية لأنماط فشل محددة مثل سقوط القنوات والمحتوى التالف، مما يستوجب تحولاً يتجاوز مجرد الدقة في البيانات النظيفة نحو تعزيز المتانة والقابلية للتفسير والقدرة التعبيرية في تطويرها.

Urban Širca, Maryam Alimardani, Stefanos Zafeiriou, Konstantinos Barmpas2026-05-19
💬 NLP

Generalization or Memorization? Brittleness Testing for Chess-Trained Language Models

تتحدى هذه الورقة البحثية المفهوم القائل بأن الدرجات المرتف High في الاختبارات المعيارية للنماذج اللغوية المدربة على الشطرنج تشير إلى فهم حقيقي للقواعد، محتجةً بدلاً من ذلك بأن أداءها ينبع من مطابقة الأنماط، ومبينةً أن دمج النماذج اللغوية الكبيرة العامة مع أدوات تحقق خارجية يوفر بديلاً أكثر مرونة وفعالية من حيث التكلفة مقارنة بالضبط الدقيق المتخصص.

Ethan Tang2026-05-19
💻 computer science

ECG-WM: A Physiology-Informed ECG World Model for Clinical Intervention Simulation

تقدم هذه الورقة ECG-WM، وهو نموذج عالم مستند إلى الفسيولوجيا يدمج مسبقات المعادلات التفاضلية العادية في ديناميكيات الانتشار الكامن لمحاكاة مسارات قلبية مشروطة بالأفعال وتوفير تقييمات للتدخلات السريرية مدركة لعدم اليقين.

Zhikang Chen, Yue Wang, Sen Cui, Yu Zhang, Changshui Zhang, Tianling Ren, Tingting Zhu2026-05-19
💻 computer science

AutoRubric-T2I: Robust Rule-Based Reward Model for Text-to-Image Alignment

يُعد AutoRubric-T2I إطار عمل مبتكرًا يقوم تلقائيًا بتوليد واختيار معايیاں (rubrics) صريحة وقابلة للتفسير لتوجيه نماذج الرؤية واللغة الحاكمة، مما يحقق أفضل النتائج في محاذاة النص إلى الصورة مع قابلية تفسير عالية واعتماد أدنى على بيانات التفضيل البشري واسعة النطاق.

Kuei-Chun Kao, Daixuan Huo, Yuanhao Ban, Cho-Jui Hsieh2026-05-19
💻 computer science

GraphMind: From Operational Traces to Self-Evolving Workflow Automation

يُعد GraphMind نظاماً متكاملاً ذاتي التطور يقوم تلقائياً ببناء وتنفيذ وتحسين رسوم بيانية لسير العمل المتمحور حول الإجراءات من خلال آثار العمليات باستخدام محرك تجول متعدد الوكلاء وتجول تعزيزي تكيفي، متفوقاً بشكل كبير على الطرق المرجعية في التحقيق في الحوادث داخل المؤسسات.

Yiwen Zhu, Joyce Cahoon, Anna Pavlenko, Qiushi Bai, Nima Shahbazi, Divya Vermareddy, Meina Wang, Mathieu Demarne, Swati (…)2026-05-19
💻 computer science

Prediction of Challenging Behaviors Associated with Profound Autism in a Classroom Setting Using Wearable Sensors

تُظهر هذه الدراسة أن النماذج التأسيسية الضبطية الدقيقة يمكنها التنبؤ بالسلوكيات الصعبة في حالات التوحد العميق قبل حدوثها بمدة تصل إلى 10 دقائق، وذلك بمعامل مساحة تحت منحنى خصائص تشغيل المستقبِل (AUC-ROC) يبلغ 0.78، من خلال تحليل بيانات أجهزة الاستشعار القابلة للارتداء متعددة الوسائط التي جُمعت من تسعة أفراد في فصل دراسي للتربية الخاصة في بيئة واقعية، مما يمهد الطريق لتدخلات سلامة استباقية.

Yadhu Kartha, Conor Anderson, Jenny Foster, Theresa Hamlin, Johanna Lantz, Ryan Lay, Juergen Hahn, Gari D. Clifford, Hye (…)2026-05-19