🤖 machine learning

Retrieval with Multiple Query Vectors through Anomalous Pattern Detection

تقترح هذه الورقة طريقة استرجاع مبتكرة تستفيد من كشف الأنماط الشاذة لتحديد واسترجاع ناقلات قواعد البيانات التي تشترك في أبعاد بارزة مع مجموعة من ناقلات الاستعلام المتعددة، مما يثبت أن استخدام مجموعات استعلام أكبر يحسن عمومًا أداء الاسترجاع عبر مختلف أنماط البيانات.

Allassan Tchangmena A Nken, Baimam Boukar Jean Jacques, Miriam Rateike, Celia Cintas, Skyler Speakman2026-05-05
🤖 machine learning

MER-DG: Modality-Entropy Regularization for Multimodal Domain Generalization

تقدم هذه الورقة MER-DG، وهي طريقة غير مرتبطة بهيكلية معينة تستخدم تنظيم اعتلاج النمط (modality-entropy regularization) لمنع "الفرط في التخصيص للدمج" (fusion overfitting) الناتج عن الاعتماد على التلازمات عبر الوسائط الخاصة بالمصدر، مما يحسن بشكل كبير أداء تعميم النطاق متعدد الوسائط على معايير مثل EPIC-Kitchens وHAC.

Yavuz Yarici, Ghassan AlRegib2026-05-05
🤖 machine learning

Misclassification Rate and Privacy-Utility Trade-offs in Graph Convolutional Networks via Subsampling Stability

تضع هذه الورقة أول إطار نظري صارم للخصوصية التفاضلية في الشبكات العصبية التلافيفية الرسومية من خلال اشتقاق حدود معدل خطأ التصنيف وتوصيف المقايضة بين الخصوصية والمنفعة من منظور استقرار أخذ العينات الفرعية.

Yexin Zhang, Zhongtian Ma, Qiaosheng Zhang, Zhen Wang2026-05-05
🤖 machine learning

Real-Time Text Transmission via LLM-Based Entropy Coding over Fixed-Rate Channels

تتناول هذه المساهمة المقايضة بين الضغط وزمن الاستجابة في نقل النصوص في الوقت الفعلي عبر ترميز الإنتروبيا القائم على النماذج اللغوية الكبيرة عبر قنوات ذات معدل ثابت، وتُظهر أنه بينما يُعد ترميز هوفمان أمثلاً للقنوات ذات السعة الزائدة مع زمن استجابة خوارزمي صفري، فإن النماذج اللغوية الأكبر تقلل معدلات البت بشكل كبير، مما يغير اختيار المرمز الأمثل، مع التحقق من النتائج عبر نطاق بارامتري يبلغ 25 ضعفاً من GPT-2 إلى Llama 3.2.

Vishnu Teja Kunde, Jean-Francois Chamberland, Krishna R. Narayanan, Jamison Ebert2026-05-05
⚡ electrical engineering

Benchmarking Wireless Representations: High-Dimensional vs. Compressed Embeddings for Efficiency and Robustness

تقوم هذه الورقة البحثية بقياس أداء التضمينات اللاسلكية عالية الأبعاد مقابل التمثيلات القائمة على المشفرات التلقائية المضغوطة والبيانات الخام، كاشفةً أنه في حين توفر النماذج عالية الأبعاد مزايا التعلم من عينات قليلة، فإن التضمينات المضغوطة توفر متانة فائقة ضد الضجيج وتكاليف حوسبة ونقل أقل بكثير عبر مختلف المهام اللاحقة.

Murilo Batista, Shirin Salehi, Saeed Mashdour, Paul Zheng, Rodrigo C. de Lamare, Anke Schmeink2026-05-05
📊 statistics

MIRA: A Score for Conditional Distribution Accuracy and Model Comparison

تقدم هذه الورقة MIRA، وهو مقياس قائم على العينات يقيم دقة التوزيعات الشرطية المرشحة ويُمكّن من مقارنة النماذج البايزية من خلال قياس مدى التوافق مع عملية توليد البيانات الحقيقية دون الحاجة إلى حساب الدليل.

Sammy Sharief, Justine Zeghal, Gabriel Missael Barco, Pablo Lemos, Yashar Hezaveh, Laurence Perreault-Levasseur2026-05-05
🤖 machine learning

Robust and Explainable Divide-and-Conquer Learning for Intrusion Detection

تقترح هذه الورقة تقنية تعلم تعتمد على مبدأ "فرق تسد" مع مراعاة الارتباط، والتي تعمل على تفكيك مهام كشف التسلل المعقدة إلى مشكلات فرعية أصغر، مما يمكن النماذج خفيفة الوزن مثل أشجار القرار من تحقيق دقة أعلى بكثير، وتقليص حجم النموذج بشكل جذري، وتحسين المتانة والقابلية للتفسير على الأجهزة ذات الموارد المحدودة.

Yan Zhou, Kevin Hamlen, Michael De Lucia, Murat Kantarcioglu, Latifur Khan, Sharad Mehrotra, Ananthram Swami, Bhavani Th (…)2026-05-05
🤖 machine learning

TIJERE: A Novel Threat Intelligence Joint Extraction Model Based on Analyst Expert Knowledge

تقدم هذه الورقة البحثية نموذج TIJERE، وهو نموذج مبتكر لاستخراج الكيانات والعلاقات بشكل مشترك يستفيد من المعرفة الخبيرة للمحللين ونموذج +SecureBERT مضبوط الدقة ضمن إطار عمل لوسم المتواليات المتعددة لتحقيق أداء رائد في مجال استخبارات التهديدات السيبرانية، إلى جانب إصدار أول مجموعة بيانات موسومة بشكل مشترك متاحة للجمهور، DNRTI-JE، لمعالجة الفجوات الحالية في التحليل الآلي للتهديدات.

Inoussa Mouiche, Sherif Saad2026-05-05
🤖 machine learning

DR-SNE: Density-Regularized Stochastic Neighbor Embedding

تقدم هذه الورقة DR-SNE، وهي طريقة لتقليل الأبعاد تعمل على تعزيز هدف تضمين الجيران العشوائي القياسي بحد تنظيم الكثافة للحفاظ صراحةً على تغيرات كثافة البيانات النسبية مع الحفاظ على بنية الجوار المحلي، مما يحسن الأداء في المهام الحساسة للكثافة مثل اكتشاف الشذوذ.

Maksim Kazanskii2026-05-05
💬 NLP

Pair2Score: Pairwise-to-Absolute Transfer for LLM-Based Essay Scoring

تقدم الورقة البحثية Pair2Score، وهو إطار عمل ثنائي المراحل وفعال من حيث المعلمات ينقل المقارنات الزوجية إلى تقييم مطلق للمقالات عبر تكييف نموذج LLaMA، مما يثبت أن تكوينات نقل محددة ومراحل تدريب زوجية محدودة تحسن دقة التقييم بشكل كبير مقارنة بالنماذج المعتمدة على التقييم المطلق فقط.

İbrahim Rıza Hallaç, Hasan Oğul2026-05-05