🤖 AI

From Ontology Conformance to Admissible Reconfiguration: A RoSO/SMGI Adequacy Argument for Robotic Service Governance

تجادل هذه الورقة بأن النموذج الهيكلي للذكاء العام (SMGI) يوفر إطار الحوكمة الرسمي اللازم لتوسيع أنطولوجيا الخدمات الروبوتية (RoSO) لما وراء المطابقة الساكنة، من خلال وضع معايير لإعادة التشكيل المقبولة أثناء وقت التشغيل بما يضمن بقاء دلالات الخدمة محفوظة أثناء التغييرات الديناميكية.

Aomar Osmani2026-05-12
⚡ electrical engineering

Rethinking Entropy Minimization in Test-Time Adaptation for Autoregressive Models

تؤسس هذه الورقة لأساس رياضي موحد وصارم لتقليل الإنتروبيا في وقت الاختبار في النماذج ذات التوليد الذاتي، وذلك عبر تفكيك الهدف إلى فقدان تدرج السياسة وفقدان الإنتروبيا على مستوى الرمز (token)، مما يثبت تحسينات مستمرة في الأداء عبر مجالات متنوعة باستخدام نموذج Whisper للتعرف التلقائي على الكلام (ASR).

Wei-Ping Huang, Chee-En Yu, Guan-Ting Lin, Hung-yi Lee2026-05-12
🤖 AI

A Robust Out-of-Distribution Detection Framework via Synergistic Smoothing

تقدم هذه الورقة البحثية ROSS، وهو إطار عمل قوي للكشف عن القيم الخارجة عن التوزيع (out-of-distribution) بعد عملية التدريب (post-hoc)، يستفيد من التنعيم بالوسيط (median smoothing) لقياس عدم استقرار الدرجة المحلية، مما يحقق متانة متماثلة هي الأفضل حالياً ضد هجمات تقليل الدرجة وهجمات تعظيم الدرجة العدائية.

Maria Stoica, Abdelrahman Hekal, Alessio Lomuscio2026-05-12
🤖 AI

NeurIPS Should Require Reproducibility Standards for Frontier AI Safety Claims

تجادل هذه الورقة الموقفية بوجوب فرض مؤتمر "نيوريبس" (NeurIPS) لمعايير قابلية التكرار فيما يتعلق بادعاءات سلامة الذكاء الاصطناعي الرائدة، مقترحةً إطار إفصاح ثلاثي المستويات لمعالجة حالة "الانعكاس الأدلي" الراهنة حيث تكون أكثر تأكيدات السلامة خطورة هي الأقل قابلية للتحقق بسبب حجب المصوغات البرمجية.

Varad Vishwarupe, Nigel Shadbolt, Marina Jirotka, Ivan Flechais2026-05-12
🤖 AI

Normalization Equivariance for Arbitrary Backbones, with Application to Image Denoising

تقدم هذه الورقة البحثية غلافاً خالياً من المعلمات يسمى WNE يفرض التكافؤ في التطبيع (Normalization Equivariance) حول أي بنية هيكلية خلفية اختيارية من خلال استخدام تحليل (normalize-process-denormalize) إلى عملية تطبيع ومعالجة وإلغاء تطبيع، مما يحسن المتانة تجاه تحولات التوزيع في إزالة ضجيج الصور دون تكبد عبء وقت التشغيل أو القيود الهيكلية للطرق الحالية.

Youssef Saied, François Fleuret2026-05-12
🤖 machine learning

ReplaySCM: A Benchmark for Executable Causal Mechanism Induction from Interventions

تقدم هذه الورقة ReplaySCM، وهو معيار مرجعي جديد يقيم قدرة النماذج اللغوية على استنتاج آليات سببية بولينية قابلة للتنفيذ من البيانات التدخلية عبر تقييم تعميم سلوكها عن طريق إعادة التشغيل بدلاً من مطابقة الصيغ النحوية، مما يكشف عن فجوات أداء كبيرة عندما تكون المعلومات الهيكلية مخفية.

Serafim Batzoglou2026-05-12
🤖 machine learning

FairHealth: An Open-Source Python Library for Trustworthy Healthcare AI in Low-Resource Settings

تقدم الورقة البحثية FairHealth، وهي مكتبة مفتوحة المصدر بلغة بايثون صُممت لسد الفجوات الحرجة في الذكاء الاصطناعي للرعاية الصحية في البيئات ذات الموارد المحدودة، وذلك من خلال توفير إطار عمل موحد ونمطي يدمج تدقيق العدالة، والتعلم الاتحادي المحافظ على الخصوصية، والقابلية للتفسير في ظل انخفاض عرض النطاق الترددي، والأدوات المتخصصة لمجموعات بيانات دول الجنوب العالمي.

Farjana Yesmin2026-05-12✓ Author reviewed
🤖 AI

Where Reliability Lives in Vision-Language Models: A Mechanistic Study of Attention, Hidden States, and Causal Circuits

تتحدى هذه الورقة البحثية الحدس القائل بأن خرائط الانتباه الحادة تشير إلى الموثوقية في نماذج الرؤية واللغة، حيث تُثبت من خلال التحليل الآلي أن بنية الانتباه هي متنبئ شبه معدوم بالصحة، بينما توفر هندسة الحالة الخفية ودوائر الطبقات المتأخرة المتفرقة مؤشرات أكثر دقة بكثير على موثوقية النموذج.

Logan Mann, Ajit Saravanan, Ishan Dave, Shikhar Shiromani, Saadullah Ismail, Yi Xia, Emily Huang2026-05-12
🤖 machine learning

Weakly Supervised Concept Learning for Object-centric Visual Reasoning

تقدم هذه الورقة إطار عمل عصبي-رمزي خاضع للإشراف الضعيف يجمع بين الإدراك المرتكز على الكائنات القائم على الفتحات (slot-based) والمشفرات التلقائية التباينية لتأصيل الرموز من أجل الاستدلال المنطقي، محققةً أداءً عالياً وتعميماً للمجالات بما لا يزيد عن 1% فقط من البيانات المصنفة مع التفوق على النماذج التأسيسية الرائدة.

Sparsh Tiwari, Bettina Finzel, Gesina Schwalbe2026-05-12
⚡ electrical engineering

Bangla-WhisperDiar: Fine-Tuning Whisper and PyAnnote for Bangla Long-Form Speech Recognition and Speaker Diarization

تقدم هذه الورقة البحثية Bangla-WhisperDiar، وهو نظام قوي يعمل على ضبط نماذج Whisper وPyAnnote من خلال تعزيز البيانات المكثف ومسار معالجة مخصص لتحقيق أداء يضاهي أحدث ما توصل إليه العلم في التعرف على الكلام طويل المدى وتحديد هوية المتحدث باللغة البنغالية، محققاً معدل خطأ في الكلمات قدره 0.2441 ومعدل خطأ في تحديد الهوية قدره 0.2392.

Mohammed Aman Bhuiyan, Md Sazzad Hossain Adib, Samiul Basir Bhuiyan, Amit Chakraborty, Aritra Islam Saswato, Ahmed Faizu (…)2026-05-12