📊 statistics

VLM Judges Can Rank but Cannot Score: Task-Dependent Uncertainty in Multimodal Evaluation

تقدم هذه المساهمة إطار عمل للتنبؤ المطابق لقياس موثوقية أحكام نماذج الرؤية واللغة عبر تحويل التقديرات النقطية إلى فترات مُعايرة، وتُظهر أن عدم اليقين في التقييم يعتمد بشكل كبير على المهمة، وتكشف عن نمط فشل حرج يتمثل في "انفصال التصنيف عن التقييم"، حيث يمكن للنماذج ترتيب الاستجابات بشكل صحيح ولكنها تفشل في تقديم درجات مطلقة موثوقة.

Divake Kumar, Sina Tayebati, Devashri Naik, Ranganath Krishnan, Amit Ranjan Trivedi2026-04-29
🤖 machine learning

DGLight: DQN-Guided GRPO Fine-Tuning of Large Language Models for Traffic Signal Control

تقدم الورقة البحثية DGLight، وهو إطار عمل مبتكر يقوم بضبط نموذج لغوي كبير مُدرب مسبقاً للتحكم في إشارات المرور من خلال الاستفادة من ناقد شبكة كيو العميقة (Deep Q-Network) لتوجيه تحسين السياسة النسبي الجماعي (Group Relative Policy Optimization)، مما ينتج عنه نظام يحقق أداءً رائداً بين المتحكمات القائمة على النماذج اللغوية الكبيرة مع توفير مسارات استدلال تفسيرية.

Chenbo Yu2026-04-29
🤖 machine learning

Optimization-Free Topological Sort for Causal Discovery via the Schur Complement of Score Jacobians

تقدم هذه الورقة خوارزمية الترتيب الطوبولوجي لـ "سكور-شور" (SSTS)، التي تتجاوز التحسين الهيكلي غير المحدب عبر استخراج الترتيب السببي مباشرة من متممة شور لجاكوبيات الدرجة، مما يعيد صياغة الاكتشاف السببي القابل للتوسع كمسألة تقدير إحصائي قادرة على التعامل مع الرسوم البيانية غير الخطية عالية الأبعاد.

Rui Wu, Hong Xie2026-04-29
🤖 machine learning

Safe-Support Q-Learning: Learning without Unsafe Exploration

تقترح هذه الورقة "تعلم كيو المدعوم بالسلامة" (Safe-Support Q-Learning)، وهو إطار عمل ثنائي المراحل يقضي على زيارة الحالات غير الآمنة أثناء تدريب التعلم التعزيزي من خلال الاستفيد من سياسة سلوكية مدعومة على مجموعة آمنة وتوظيف هدف بلمان مُنظّم بتباعد كولباك - ليبلر (KL-regularized Bellman target) لاستخلاص سياسة آمنة وعالية الأداء دون المساس بالاستكشاف داخل المنطقة الآمنة.

Yeeun Lim, Narim Jeong, Donghwan Lee2026-04-29
🤖 machine learning

Subspace Optimization for Efficient Federated Learning under Heterogeneous Data

تقترح هذه الورقة البحثية "تحسين الفضاء الجزئي للتعلم الاتحادي" (SSF)، وهي طريقة تخفف من الانحراف الناتج عن عدم تجانس البيانات من خلال إجراء عملية التحسين في فضاء جزئي منخفض الأبعاد مع تحديثات بأسلوب الملء اللاحق للاحتفاظ بالمعلومات المتبقية، مما يحقق دقة عالية مع تقليل عبء الاتصالات والذاكرة بشكل كبير مقارنة بالأساليب الحالية.

Shuchen Zhu, Zhengyang Huang, Yuqi Xu, Peijin Li2026-04-29
🌀 nonlinear sciences

Emergent Self-Attention from Astrocyte-Gated Associative Memory Dynamics

تقترح هذه الورقة نموذج ذاكرة ترابطية من نوع هوبفيلد، حيث يقوم تعديل الكسب المنظم بالاعتلاج (الإنتروبيا) والوسيط عبر الخلايا النجمية بتنفيذ آليات الانتباه الذاتي ديناميكياً، مما يؤدي إلى تحسين دقة الاسترجاع بشكل كبير تحت أحمال الذاكرة العالية مقارنة بالنهج الكلاسيكية.

Arnau Vivet, Alex Arenas2026-04-29
🤖 machine learning

Dyna-Style Safety Augmented Reinforcement Learning: Staying Safe in the Face of Uncertainty

تقترح الورقة البحثية خوارزمية Dyna-SAuR، وهي خوارزمية تعلم تعزيزي مبتكرة تستخدم نموذج ديناميكيات مدرك لعدم اليقين تم تعلمه لتدريب مرشح سلامة وسياسة تحكم قابل للتوسع في آن واحد، مما يقلل بشكل كبير من حالات فشل التدريب في الأنظمة عالية الأبعاد مقارنة بالأساليب المتطورة.

Artur Eisele, Bernd Frauenknecht, Friedrich Solowjow, Sebastian Trimpe2026-04-29
🤖 machine learning

Egocentric Tactile and Proximity Sensors as Observation Priors for Humanoid Collision Avoidance

تقدم هذه الورقة إطار عمل للتعلم التعزيزي لتجنب الاصطدام لكامل جسم الروبوت البشري، مبرهنةً على أن قياسات التقارب الخام ذات المدى الكافي يمكن أن تحل محل تحديد موقع الأجسام الصريح، وأن الإشارات المتفرقة وغير الاتجاهية توفر كفاءة عينة متفوقة مقارنة بالبدائل الكثيفة والاتجاهية.

Carson Kohlbrenner, Niraj Pudasaini, William Xie, Naren Sivagnanadasan, Nikolaus Correll, Alessandro Roncone2026-04-29
🤖 machine learning

Dictionary learning for Kernel EDMD

تقترح هذه الورقة نهجاً لتعلم القاموس لنموذج تحليل الأنماط الديناميكية الممتد عبر النواة (kEDMD) يستخدم التحسين القائم على التدرج لتعلم وتقليم معلمات النواة تلقائياً من قائمة موزونة، مما يؤدي إلى تبسيط تقريب مؤثر كوپمان للأنظمة الديناميكية غير الخطية.

Erik Lien Bolager, Boumediene Hamzi, Houman Owhadi, Ioannis G. Kevrekidis, Felix Dietrich2026-04-29
🤖 machine learning

Towards interpretable AI with quantum annealing feature selection

تقترح هذه الورقة طريقة مبتكرة لتفسير الشبكات العصبية الالتفافية في تصنيف الصور من خلال صياغة اختيار خرائط الميزات كمسألة تحسين كمي مقيدة تُحل عبر التلدين الكمي، والتي تتفوق على التقنيات الرائدة مثل GradCAM في فك تشابك الفئات والشفافية مع توفير رؤى نظرية حول السلوك الحسابي للخوارزمية.

Francesco Aldo Venturelli, Emanuele Costa, Sikha O K, Bruno Juliá-Díaz, Miguel A. González Ballester, Alba Cervera-Liert (…)2026-04-29