💬 NLP

When Correct Isn't Usable: Improving Structured Output Reliability in Small Language Models

تحدد هذه الورقة فجوة حرجة في الموثوقية حيث تفشل النماذج اللغوية الصغيرة في إنتاج مخرجات صحيحة رياضياً ومتوافقة مع التنسيق المطلوب تحت التوجيه القياسي، وتقترح AloLab، وهو نظام وكيل ميتا تكراري يعمل على تحسين توجيهات النظام لتحقيق دقة عالية في المخرجات مع زمن استجابة يقارب الأداء الأصلي دون الحاجة إلى ضبط دقيق للنموذج أو فك ترميز مقيد.

Cosimo Galeone, Minsu Park, Giuseppe Ettorre, Daniele Ligorio2026-05-05
🔬 optics

CNNs for Vis-NIR Chemometrics: From Contradiction to Conditional Design

تعمل هذه الورقة المراجعية على حل النتائج المتناقضة في الكيمياء القياسية للأطياف المرئية وفوق الحمراء القريبة فيما يتعلق بتصميم الشبكات العصبية الالتفافية، وذلك من خلال إرجاعها إلى متغيرات معدلة غير منضبطة، وتقترح إطار عمل للتصميم الشرطي يربط بين بنية النموذج وخيارات المعالجة المسبقة وبين فيزياء الأطياف، وخصائص مجموعة البيانات، وسيناريوهات النشر.

Dário Passos2026-05-05
🧬 biology

Online Generalised Predictive Coding

تقدم هذه الورقة الترميز التنبؤي العام عبر الإنترنت (ODEM)، وهو امتداد لتعظيم التوقع الديناميكي يتيح الاستدلال المتزامن عبر الإنترنت للحالات الكامنة، وتعلم معلمات النموذج، وتقدير عدم اليقين في البيئات الديناميكية من خلال الفصل بين المقاييس الزمنية، مما يثبت متانته حتى مع النماذج التوليدية غير المتطابقة أو الفوضوية.

Mehran H. Z. Bazargani, Szymon Urbas, Adeel Razi, Thomas Brendan Murphy, Karl Friston2026-05-05
📊 statistics

Random-Effects Algorithm for Random Objects in Metric Spaces

تقترح هذه الورقة خوارزمية آثار عشوائية غير خطية قائمة على "فريشيه" لنمذجة الأجسام العشوائية التعسفية في الفضاءات المترية، حيث تثبت اتساقها من خلال نظرية تقدير "M"، وتُظهر أداءً فائقاً على طرق "هيلبرت" القائمة على الفضاءات الهيلبرتية في كل من مجموعات البيانات الاصطناعية والبيانات الصحية الرقمية.

Marcos Matabuena, Mateo Cámara2026-05-05
⚡ electrical engineering

Dimensionality-Aware Anomaly Detection in Learned Representations of Self-Supervised Speech Models

تقدم هذه الورقة إطار عمل GRIDS، الذي يستفيد من البعد الجوهري المحلي (LID) على مستوى الطبقات في نماذج الكلام ذات التعلم الذاتي للكشف عن الشذوذ عبر تحديد كيفية قيام الاضطرابات العدائية والضوضائية بتشويه البنى الهندسية المحلية بشكل فريد، مما يربط بين تحولات الـ LID وتدهور التعرف التلقائي على الكلام ويُمكّن من المراقبة دون الحاجة إلى نصوص مكتوبة.

Sandra Arcos-Holzinger, Sarah M. Erfani, James Bailey, Sanjeev Khudanpur2026-05-05
📊 statistics

Universality in Deep Neural Networks: An approach via the Lindeberg exchange principle

تضع هذه الورقة حدوداً كمية لتقارب الشبكات العصبية العميقة كاملة الاتصال إلى حدودها الغاوسية ذات العرض اللانهائي من خلال تطبيق مبدأ تبادل ليندبرغ لاستبدال أوزان الطبقات بالتتابع بمتغيرات عشوائية غاوسية.

Filippo Giovagnini, Sotirios Kotitsas, Marco Romito2026-05-05
🤖 AI

Explaining the Explainers in Graph Neural Networks: a Comparative Study

تقدم هذه الورقة دراسة مقارنة منهجية لعشرة من أدوات تفسير الشبكات العصبية الرسومية (GNN explainers) عبر ثماني بنيات وست مجموعات بيانات لتقديم رؤى عملية حول أدائها، وتحديد عوامل النجاح الرئيسية، وتقديم توصيات لتجنب عثرات التفسير.

Antonio Longa, Steve Azzolin, Gabriele Santin, Giulia Cencetti, Pietro Liò, Bruno Lepri, Andrea Passerini2026-05-04
⚛️ quantum physics

Efficient Finite Initialization with Partial Norms for Tensorized Neural Networks and Tensor Networks Algorithms

تقدم هذه الورقة خوارزميتين فعالتين لتهيئة الشبكات العصبية الموترة وخوارزميات الشبكة الموترية العامة من خلال الاستخدام التكراري لمعايير فروبينيوس الجزئية والمجاميع الخطية الإيجابية لعناصر الشبكات الفرعية لتحقيق التطبيع المحدود مع الاستفادة من إعادة استخدام الحسابات الوسيطة.

Alejandro Mata Ali, Iñigo Perez Delgado, Marina Ristol Roura, Aitor Moreno Fdez. de Leceta2026-05-04
🤖 machine learning

Value Explicit Pretraining for Learning Transferable Representations

تقترح هذه الورقة البحثية طريقة "التعلم المسبق الصريح للقيمة" (Value Explicit Pretraining - VEP)، وهي طريقة تعلم ذاتي مستوحاة من التقديرات غير المثالية للبيانات غير المصنفة وتقديرات قيمة "مونت كارلو" لتعلم تمثيلات ثابتة تجاه البيئة، مما يحسن بشكل كبير من كفاءة العينات والقدرة على التعميم في مهام التعلم التعزيزي الانتقالي مقارنة بالأساليب المتطورة الحالية.

Kiran Lekkala, Henghui Bao, Sumedh A. Sontakke, Erdem Biyik, Laurent Itti2026-05-04
💬 NLP

Laissez-Faire Harms: Algorithmic Biases in Generative Language Models

تُظهر هذه الدراسة أن خمسة نماذج لغوية توليدية ضخمة، عند نشرها في بيئات "الاسترخاء" الطبيعية دون مطالبات هوية صريحة، تكرس بشكل منهجي عمليات الحذف والإخضاع والنمطية الضارة تجاه الأشخاص من الأقليات، وتولد مخرجات تمييزية تزيد احتمالية كونها سلبية بمئات إلى آلاف المرات عن كونها تمكينية، وتشكل مخاطر نفسية جسيمة.

Evan Shieh, Faye-Marie Vassel, Cassidy Sugimoto, Thema Monroe-White2026-05-04