🤖 AI

CUDA-L1: Improving CUDA Optimization via Contrastive Reinforcement Learning

تقدم هذه الورقة البحثية CUDA-L1، وهو إطار عمل للتعلم التعزيزي التبايني يحول نموذج لغوي كبير قياسي إلى مُحسِّن CUDA آلي فعال قادر على تحقيق تسريع كبير عبر مختلف بنيات وحدات معالجة الرسومات والمقاييس المرجعية دون الحاجة إلى خبرة بشرية.

Xiaoya Li, Albert Wang, Guoyin Wang, Jiwei Li, Chris Shum2026-08-07
🤖 AI

APTx Neuron: A Unified Trainable Neuron Architecture Integrating Activation and Computation

تقدم الورقة البحثية "APTx Neuron"، وهي بنية موحدة قابلة للتدريب تدمج التنشيط غير الخطي والتحويل الخطي في تعبير واحد لتعزيز كفاءة التحسين والقدرة التعبيرية، مما أظهر أداءً فائقاً على مجموعة بيانات MNIST مقارنة بالخلايا العصبية التقليدية.

Ravin Kumar2026-08-07
🤖 machine learning

Dynamic Object Masks as Goal Representations for Visual Goal-Conditioned Reinforcement Learning

تقترح هذه الورقة تمثيلاً للهدف يعتمد على قناع كائن ديناميكي لتعلم التعزيز البصري المشروط بالهدف، مما يلغي الحاجة إلى معلومات الحالة المتميزة عبر استخدام معالجة الصور القياسية أو الكواشف مسبقة التدريب لتوليد إشارات بصرية غير مرتبطة بالكائنات، وبالتالي تحقيق معدلات نجاح عالية، وتعميم قوي على الكائنات غير المرئية، ونقل ناجح من المحاكاة إلى الواقع على الأذرع الروبوتية.

Fahim Shahriar, Cheryl Wang, Alireza Azimi, Gautham Vasan, Hany Hamed, Abhishek Naik, A. Rupam Mahmood, Colin Bellinger2026-08-07
⚡ electrical engineering

Worst-Case Distance-Aware Error Bounds for Neural Networks

تقدم هذه الورقة البحثية K-DAREK، وهو إطار عمل مبتكر يجمع بين الطبقات الكثيفة والمكونات القائمة على الـ spline لتوفير حدود خطأ حتمية، وفعالة، وقابلة للتفسير، ومدركة للأسوأ من حيث المسافة للشبكات العصبية، متفوقاً بذلك على الأساليب الحالية مثل العمليات الغاوسية (Gaussian processes) ومجموعات KAN في قابلية التوسع، والكفاءة الحسابية، والموثوقية في الحالات الحرجة للسلامة.

Masoud Ataei, Vikas Dhiman, Mohammad Javad Khojasteh2026-08-07
📊 statistics

On the Anisotropy of Score-Based Generative Models

تقدم هذه الورقة "اتجاهات تباين الدرجة" (SADs)، وهي مقياس يعتمد على البنية التحتية يكشف كيف يشكل تصميم الشبكة الانحيازات الاستقرائية للنماذج التوليدية القائمة على الدرجة، مما يتيح التنبؤ بأداء تعميمها وسلوكها الاتجاهي قبل التدريب.

Andreas Floros, Seyed-Mohsen Moosavi-Dezfooli, Pier Luigi Dragotti2026-08-07
🤖 machine learning

Precipitation nowcasting of satellite data using physically-aligned neural networks

تقدم الورقة البحثية TUPANN، وهي شبكة عصبية تعتمد على الأقمار الصناعية فقط ومتوافقة فيزيائياً، تقوم بتفكيك التنبؤ بالهطول الآني إلى مكونات حركة وكثافة قابلة للتفسير، محققةً مهارة رائدة عالمياً عبر مختلف المناخات العالمية وعتبات الأمطار الغزيرة مع توفير أداء يقارب الوقت الحقيقي.

Antônio Catão, Melvin Poveda, Leonardo Voltarelli, Paulo Orenstein2026-08-07
💬 NLP

All-Quadrant Bounded Clipping GRPO: Closing the Unbounded Blind Spot for Stable and Generalizable Training

تقدم هذه الورقة خوارزمية ABC-GRPO (التقليم المقيد بجميع الأرباع لـ GRPO)، وهي خوارزمية تعلم تعزيزي مبتكرة تعالج عدم المحدودية الهيكلية في ربع الميزة السالبة في خوارزمية GRPO القياسية عن طريق تطبيق تقليم غير مشروط لضمان تدريب مستقر وعالي الإنتروبيا وتعميم فائق في معايير الرياضيات والبرمجة.

Chi Liu, Xin Chen2026-08-07
🤖 AI

FI-TW: An Open Train-Weather Dataset for Railway Delay Analysis in Finland

تقدم هذه الورقة FI-TW، وهي أول مجموعة بيانات مفتوحة تدمج بيانات تشغيل السكك الحديدية الفنلندية مع ملاحظات الأرصاد الجوية المتزامنة من عام 2018 إلى 2024، مما يتيح تطبيقات تعلم آلي متقدمة لتحليل تأخيرات القطارات الناجمة عن الطقس والتنبؤ بأوقات الوصول الخاصة بكل محطة.

Vinicius Pozzobon Borin, Jean Michel de Souza Sant'Ana, Usama Raheel, Nurul Huda Mahmood2026-08-07
🤖 AI

Trust-Based Incentive Mechanisms in Semi-Decentralized Federated Learning Systems

تقترح هذه الورقة آلية تحفيز قائمة على الثقة ومبتكرة للتعلم الاتحادي شبه اللامركزي، تقوم بتقييم مساهمات المشاركين ديناميكيًا لمكافأة السلوك الأمين ومعاقبة العقد الخبيثة، وذلك باستخدام البلوكشين والعقود الذكية لضمان بيئة شفافة وقوية وعادلة.

Ajay Kumar Shrestha2026-08-07
💬 NLP

STATe-of-Thoughts: Structured Action Templates for Tree-of-Thoughts

تقدم الورقة البحثية "STATe-of-Thoughts" (STATe)، وهي طريقة قابلة للتفسير للحوسبة أثناء الاستدلال، تعمل على تحسين تنوع المخرجات والتحكم في الاستدلال من خلال البحث عبر أنماط أفعال نصية عالية المستوى ومنفصلة بدلاً من الاعتماد على أخذ عينات مستوى الرمز (token) باستخدام درجة الحرارة (temperature).

Zachary Bamberger, Till R. Saenger, Gilad Morad, Ofra Amir, Brandon M. Stewart, Amir Feder2026-08-07