📊 statistics

Coarse-Grained Boltzmann Generators

تقدم هذه الورقة "مولدات بولتزمان خشنة الحبيبات" (CG-BGs)، وهي إطار عمل يجمع بين النماذج التوليدية القائمة على التدفق وجهود متوسط القوة المتعلمة لتمكين أخذ عينات التوازن بكفاءة وصحة تقاربية للأنظمة الجزيئية الكبيرة في فضاءات إحداثيات خشنة الحبيبات مختزلة.

Weilong Chen, Bojun Zhao, Jan Eckwert, Julija Zavadlav2026-05-29
📊 statistics

Aggregate Models, Not Explanations: Improving Feature Importance Estimation

يُثبت هذا البحث، من خلال التحليل النظري والتحقق التجريبي، أن تجميع تقديرات أهمية الميزات عبر النماذج الفردية داخل مجموعة (ensemble) يُسفر عن نتائج أكثر دقة من تفسير المجموعة ككل، لا سيما بالنسبة للنماذج التعبيرية حيث يكون تقليل المخاطر الزائدة أمراً بالغ الأهمية للاكتشاف العلمي الموثوق.

Joseph Paillard, Angel Reyero Lobo, Denis A. Engemann, Bertrand Thirion2026-05-29
🤖 machine learning

Securing SIM-Assisted Wireless Networks via Quantum Reinforcement Learning

تقترح هذه الورقة إطار عمل هجين لسياسة التحسين القريبة الكمومية (QPPO) يدمج الدوائر الكمومية ذات المعلمات في شبكة الفاعل لتحسين قدرة الإرسال وإزاحات طور تعديل السعة المتغير (SIM) بكفاءة، مما يعزز بشكل كبير معدلات السرية وسرعة التقارب في الشبكات اللاسلكية المدعومة بتقنية (SIM) مقارنة بطرق التعلم المعزز العميق التقليدية.

Le-Hung Hoang, Quang-Trung Luu, Dinh Thai Hoang, Diep N. Nguyen, Van-Dinh Nguyen2026-05-29
🤖 AI

Benchmarking at the Edge of Comprehension

تقدم هذه الورقة "التقييم المرجعي المقاوم للنقد"، وهو إطار عمل تنافسي يتيح تقييم النماذج اللغوية الكبيرة الرائدة بما يتجاوز الإدراك البشري من خلال تعريف الصحة عبر عدم قدرة الخصوم على دحض الإجابات، مع استخدام البشر كمدققين محدودين للادعاءات المحلية.

Samuele Marro, Jialin Yu, Emanuele La Malfa, Oishi Deb, Jiawei Li, Yibo Yang, Ebey Abraham, Sunando Sengupta, Eric Somme (…)2026-05-29
📊 statistics

GICDM: Mitigating Hubness for Reliable Distance-Based Generative Model Evaluation

تقدم هذه الورقة البحثية نموذج GICDM (النموذج التوليدي لـ ICDM)، وهو منهج متعدد المقاييس يعمل على التخفيف من ظاهرة "المركزية" (hubness) في فضاءات التضمين عالية الأبعاد لاستعادة موثوقية ومواءمة البشر لمقاييس تقييم النماذج التوليدية القائمة على المسافة.

Nicolas Salvy, Hugues Talbot, Bertrand Thirion2026-05-29
🤖 machine learning

Is Your Diffusion Sampler Actually Correct? A Sampler-Centric Evaluation of Discrete Diffusion Language Models

تقدم هذه الورقة إطار عمل "أوراكل" (oracle) متمحوراً حول العينات لإثبات أن نماذج اللغة ذات الانتشار المنفصل (discrete diffusion language models) ذات الخطوات القليلة تعاني من أخطاء عينة متأصلة وتفشل في تحقيق الصحة التوزيعية حتى مع وجود مزيلات ضجيج مثالية، مما يكشف أن المقاييس القياسية مثل NLL والارتباك (perplexity) لا تضمن دقة أخذ العينات.

Luhan Tang, Longxuan Yu, Shaorong Zhang, Greg Ver Steeg2026-05-29
🤖 machine learning

Towards Efficient and Expressive Offline RL via Flow-Anchored Noise-conditioned Q-Learning

تقدم الورقة البحثية خوارزمية التعلم المعزز غير المتصل بالإنترنت "التعلم بـ Q المشروط بالضجيج والمثبت بالتدفق" (FAN)، وهي خوارزمية فعالة للتعلم المعزز غير المتصل بالإنترنت تحقق أداءً رائدًا في المهام الروبوتية من خلال تحسين سياسات التدفق والنقاد التوزيعيين لتتطلب تكرارًا واحدًا وعينة ضجيج واحدة فقط، مما يقلل بشكل كبير من التكاليف الحسابية دون التضحية بالدقة.

Sungyoung Lee, Dohyeong Kim, Eshan Balachandar, Zelal Su Mustafaoglu, Keshav Pingali2026-05-29
🤖 machine learning

Statistical Consistency and Generalization of Contrastive Representation Learning

تؤسس هذه الورقة نظرية تعلم إحصائي موحدة لتعلم التمثيلات التباينية، حيث تثبت الاتساق الإحصائي لخسارة التباين مع الترتيب الأمثل، وتستنتج حدود التعميم التي تفسر فوائد مجموعات العينات السالبة الكبيرة، وتوفر رابطاً كمياً بين مخاطر التباين الزائدة وعدم المثالية في الاسترجاع.

Yuanfan Li, Xiyuan Wei, Tianbao Yang, Yiming Ying2026-05-29
🤖 machine learning

Bridging Classification and Reconstruction: Cooperative Time Series Anomaly Detection

تقترح هذه الورقة CoAD، وهو إطار عمل جديد وخفيف الوزن يوحد بين نماذج كشف القيم المتطرفة ونماذج الترميز التلقائي المقنع من خلال تصميم تعاوني للتغلب على قيود التعميم وعدم توافق القناع في الطرق الحالية، مما يحقق أداءً فائقاً في اكتشاف الشذوذ في السلاسل الزمنية الدقيقة والممتدة.

Qideng Tang, Dai Chaofan, Wubin Ma, Yahui Wu, Haohao Zhou, Tao Zhang, Huan Li, Dalin Zhang2026-05-29
💻 computer science

RightNow-Arabic-0.5B-Turbo: An Open Sub-1B Arabic Language Model via Vocabulary Injection and Edge-First Deployment

تقدم هذه الورقة البحثية نموذج RightNow-Arabic-0.5B-Turbo، وهو نموذج لغوي مفتوح المصدر متخصص في اللغة العربية بـ 518 مليون معلمة، تم بناؤه على نموذج Qwen2.5-0.5B من خلال حقن المفردات والضبط الدقيق المكثف، والذي يحقق أداءً هو الأفضل في فئته بين النماذج التي يقل عدد معلماتها عن مليار معلمة، مع تمكين النشر الفعال على الأجهزة الطرفية عبر التكميم إلى أقل من 400 ميجابايت.

Jaber Jaber, Osama Jaber2026-05-29