🤖 machine learning

Cost-aware Duration Prediction for Software Upgrades in Datacenters

تقدم هذه الورقة Acela، وهو إطار عمل للتنبؤ بالمدة مع مراعاة التكلفة يعمل على تحسين جدولة ترقية البرمجيات في مراكز البيانات من خلال معالجة تكاليف الخطأ غير المتماثلة وآثار المتأخرين (stragglers)، مما أدى إلى تحسين الكفاءة والإنتاجية بشكل كبير وتقليل معدلات الإلغاء في أنظمة الإنتاج الخاصة بشركة ميتا (Meta).

Yi Ding, Aijia Gao, Thibaud Ryden, Michal Sedlak, Essam Ewaisha, Igor Marnat, Henry Hoffmann2026-05-19
⚡ electrical engineering

Causal Influences over Social Learning Networks

تتقصى هذه الورقة التأثيرات السببية داخل شبكات التعلم الاجتماعي من خلال اشتقاق تعبيرات تعتمد على الطوبولوجيا لتفاعلات الوكلاء، واقتراح خوارزمية لترتيب الوكلاء المؤثرين، وتطوير طريقة لتعلم معاملات النموذج من البيانات الرصدية.

Mert Kayaalp, Ali H. Sayed2026-05-19
🤖 machine learning

The Normal Distributions Indistinguishability Spectrum and its Application to Privacy-Preserving Machine Learning

تقدم هذه الورقة طيف عدم التمييز للتوزيعات الطبيعية (NDIS)، وهو أداة تحليلية ذات صيغة مغلقة لحساب الخصوصية التفاضلية لأي خوارزمية ذات مخرجات غاوسية، مما يتيح براهين خصوصية أكثر إحكاماً، وآليات أكثر كفاءة في الضجيج، وتدقيقاً "أبيض الصندوق" لمجموعة واسعة من تطبيقات تعلم الآلة الحافظة للخصوصية.

Yu Wei, Yun Lu, Malik Magdon-Ismail, Vassilis Zikas2026-05-19
📊 statistics

Generalization analysis with deep ReLU networks for metric and similarity learning

تقدم هذه الورقة أول تحليل تعميم صارم لتعلم المقاييس والتشابه من خلال بناء شبكات ReLU عميقة مهيكلة بناءً على الشكل الصريح للمقياس الحقيقي لاستخلاص حدود صريحة للمخاطر الزائدة توازن بين أخطاء التقريب والتقدير.

Junyu Zhou, Puyu Wang, Ding-Xuan Zhou2026-05-19
📊 statistics

What is the long-run distribution of stochastic gradient descent? A large deviations analysis

تستخدم هذه الورقة نظرية الانحرافات الكبيرة لتوضيح أن التوزيع طويل الأمد للاشتقاق المتدرج العشوائي في المسائل غير المحدبة يشبه توزيع بولتزمان-جيبس، مما يجعل الخوارزمية تفضل بشكل أسي المناطق الحرجة ذات حالات الطاقة الأدنى على المناطق غير الحرجة، والقمم المحلية، ونقاط السرج.

Waïss Azizian, Franck Iutzeler, Jérôme Malick, Panayotis Mertikopoulos2026-05-19
⚡ electrical engineering

Language Models as Efficient Reward Function Searchers for Custom-Environment Multi-Objective Reinforcement

تقترح هذه الورقة إطار عمل ERFSL، وهو إطار عمل فعال يستفيد من النماذج اللغوية الكبيرة كباحثين بنظام الصندوق الأبيض لتوليد وتحسين دوال المكافأة متعددة الأهداف بشكل تكراري في البيئات المخصصة المعقدة من خلال الفهم الدلالي، ومنتقد مكافأة لتصحيح الكود، واستراتيجيات ضبط الأوزان الشبيهة بالخوارزميات الجينية، مما يحقق تقارباً سريعاً نحو الحلول المثلى في جبهة باريتو بأقل قدر من التغذية الراجعة البشرية.

Guanwen Xie, Jingzehua Xu, Yiyuan Yang, Yimian Ding, Shuai Zhang2026-05-19
🤖 machine learning

A Practical Theory of Generalization in Selectivity Learning

تجسّر هذه الورقة البحثية الفجوة بين النظرية والتطبيق في تعلم الانتقائية القائم على الاستعلام من خلال إثبات قابلية التعلم تحت المقاييس الموقعة واستخلاص حدود تعميم خارج نطاق التوزيع، مما يؤدي إلى استراتيجيتين تعملان على تحسين دقة النموذج وزمن الاستجابة بشكل كبير في الاستعلامات خارج نطاق التوزيع مع الحفاظ على الأداء داخل النطاق.

Peizhi Wu, Haoshu Xu, Ryan Marcus, Zachary G. Ives2026-05-19
🤖 machine learning

Evaluating Inter-Column Logical Relationships in Synthetic Tabular Data Generation

تقدم هذه الورقة ثلاثة مقاييس تقييم جديدة لتقدير مدى جودة قدرة طرق توليد البيانات الجدولية الاصطناعية على الحفاظ على العلاقات المنطقية والارتباطات بين الأعمدة، مما يكشف أن النهج الحالية المتطورة غالباً ما تفشل في الحفاظ على الواقعية الدقيقة المطلوبة لتسلسلات الأحداث المتماسكة وتماسك الكيانات.

Yunbo Long, Liming Xu, Alexandra Brintrup2026-05-19
🤖 machine learning

Representational Alignment with Chemical Induced Fit for Molecular Relational Learning

تقترح الورقة البحثية ReAlignFit، وهو إطار عمل مبتكر يعزز استقرار وأداء التعلم العلائقي الجزيئي من خلال محاذاة تمثيلات البنية التحتية ديناميكيًا عبر انحياز استقرائي قائم على "الملاءمة المستحثة" كيميائيًا و"عنق زجاجة معلومات المخطط الفرعي"، مما يعالج بفعالية التحديات في توزيعات البيانات ذات القواعد المزاحة والسقالات المزاحة.

Peiliang Zhang, Jingling Yuan, Qing Xie, Yongjun Zhu, Lin Li2026-05-19
💬 NLP

Automated Knowledge Component Generation for Interpretable Knowledge Tracing in Coding Problems

تقدم هذه الورقة KCGen-KT، وهو مسار عمل مؤتمت يعتمد على النماذج اللغوية الكبيرة لتوليد وتوسيم مكونات المعرفة للمشكلات البرمجية مفتوحة النهايات، مما يثبت من خلال تقييم مكثف أن هذه المكونات المولدة بواسطة الذكاء الاصطناعي تفوق المكونات التقليدية المكتوبة بشرياً في التنبؤ بأداء الطلاب ونمذجة منحنيات التعلم.

Zhangqi Duan, Nigel Fernandez, Arun Balajiee Lekshmi Narayanan, Mohammad Hassany, Rafaella Sampaio de Alencar, Peter Bru (…)2026-05-19