💻 computer science

Are Multimodal LLMs Ready for Clinical Dermatology? A Real-World Evaluation in Dermatology

تُظهر هذه الدراسة أنه بينما تُعد النماذج اللغوية الكبيرة متعددة الوسائط واعدة في المعايير الجلدية العامة، فإن دقتها التشخيصية تنخفض بشكل كبير في البيئات السريرية الحقيقية، مما يشير إلى أن النماذج الحالية ليست موثوقة بما يكفي بعد للاستخدام بجانب السرير.

Roy Jiang, Hyunjae Kim, Zhenyue Qin, Morten Lee, Margaret MacGibeny, Ailish Hanly, Angela Sadlowski, Shanin Chowdhury, X (…)2026-05-07
🤖 machine learning

Position: the Stochastic Parrot in the Coal Mine. Model Collapse is a Threat to Low-Resource Communities

تجادل ورقة الموقف هذه بأن الانهيار النموذجي، الناجم عن تدريب الذكاء الاصطنا التوليدي على مخرجاته الخاصة، يهدد بدمقرطة الذكاء الاصطناعي من خلال تدهور جودة البيانات وكفاءتها، مما يلحق ضرراً غير متناسب بالمجتمعات ذات الموارد المنخفضة والمهمشة عبر تعزيز التحيزات الثقافية والتكاليف البيئية.

Devon Jarvis, Richard Klein, Benjamin Rosman, Steven James, Stefano Sarao Mannelli2026-05-07
💻 computer science

Frontier Lag: A Bibliometric Audit of Capability Misrepresentation in Academic AI Evaluation

يقدم هذا العمل فحصاً بيبليومترياً يظهر أن التقييمات الأكاديمية لقدرات الذكاء الاصطناعي تتخلف بشكل منهجي عن الحالة الراهنة لأحدث ما توصل إليه العلم بأكثر من عقد من الزمان، وهي فجوة تتسع بسبب تأخيرات النشر وتتفاقم بسبب التضليل الواسع النطاق لتكوينات النماذج، وكذلك بسبب الادعاءات شديدة التعميم حول "الذكاء الاصطناعي" بدلاً من الأنظمة التي تم تقييمها تحديداً.

David Gringras, Misha Salahshoor2026-05-07
📊 statistics

Heterogeneous Ordinal Structure Learning with Bayesian Nonparametric Complexity Discovery

تقدم هذه الورقة إطار عمل لتعلم البنية الترتيبية غير المتجانسة يجمع بين اكتشاف التعقيد غير البارامتري البايزي والتقدير التأكيدي للرسم البياني الموجه (DAG) الخاص بكل عنقود، وذلك لنمذجة المواقف العامة المتنوعة تجاه الذكاء الاصطناعي بشكل أفضل، مما يظهر تحسينات تنبؤية كبيرة مقارنة بالنماذج المرجعية الحالية ذات الرسم البياني الواحد أو النماذج المعتمدة على المزيج فقط على مجموعة بيانات استقصائية واسعة النطاق.

Amir Rafe, Subasish Das2026-05-07
💻 computer science

Coupled-NeuralHP: Directional Temporal Coupling Between AI Innovation Exposure and Public Response

تقدم الورقة البحثية نموذج Coupled-NeuralHP، وهو نموذج هجين يجمع بين الأحداث والحالة يلتقط بفعالية الاقتران الزمني الاتجاهي من التعرض لابتكارات الذكاء الاصطناعي إلى الاستجابة العامة، متفوقاً على النماذج المرجعية التقليدية في التنبؤ بأعداد الابتكارات واستعادة الروابط السببية في الاختبارات شبه الاصطناعية، بينما لم يجد أي دليل على وجود انكسارات في النظم في عام 2022.

Amir Rafe, Subasish Das2026-05-07
💻 computer science

AI and Suicide Prevention: A Cross-Sector Primer

تُعد هذه الورقة، التي تم تطويرها بناءً على ورشة عمل متعددة الأطراف أُقيمت في عام ٢٠٢٦، بمثابة دليل تمهيدي عابر للقطاعات يوضح أفضل الممارسات السريرية والقدرات الحالية لأنظمة الذكاء الاصطناعي الرائدة لرسم التحديات وتحديد المجالات ذات الأولوية لمواءمة مختبرات الذكاء الاصطناعي، وممارسي الصحة النفسية، وصناع السياسات في الجهود العاجلة لتحسين الوقاية من الانتحار والرفاهية.

Emily Saltz, Claire R. Leibowicz2026-05-07
🤖 AI

Evaluation Cards for XAI Metrics

لمعالجة نقص المعايير والشفافية في تقييم أساليب الذكاء الاصطناٍعي القابل للتفسير (XAI)، تقترح هذه الورقة "بطاقة تقييم الذكاء الاصطناعي القابل للتفسير"، وهي نموذج توثيق مصمم لتسجيل التفاصيل الحرجة مثل الخصائص المستهدفة، والافتراضات، وأدلة التحقق لأي مقياس جديد للذكاء الاصطناعي القابل للتفسير بشكل منهجي.

Rokas Gipiškis, Olga Kurasova2026-05-07
💻 computer science

An Evaluation of Chat Safety Moderations in Roblox

تقيم هذه الدراسة نظام الإشراف الآلي على الدردشة في روبلوكس (Roblox) من خلال تحليل مجموعة بيانات تضم مليوني رسالة، مما يكشف أن النظام الحالي يفشل في حظر مجموعة واسعة من المحتويات الضارة بفعالية — بما في ذلك الاستدراج، والمضايقة، والعنف — وأن المستخدمين يستخدمون بنشاط تقنيات متنوعة للتهرب من الكشف.

Priya Kaushik, Sonja Brown, Rakibul Hasan, Sazzadur Rahaman2026-05-07
🤖 AI

Guidelines for Designing AI Technologies to Support Adult Learning

تتناول هذه الورقة الفجوة في تصميم تكنولوجيا التعليم القائمة على الذكاء الاصطناًعي للمتعلمين البالغين من خلال تحليل بيانات النشر الطولي من معهد أبحاث أمريكي لاستخلاص والتحقق من صحة 19 إرشداً تصميمياً، مصحوبة بأداة لتسهيل تطبيقها في ابتكار الأنظمة مستقبلاً.

Jennifer M. Reddig, Glen R. Smith Jr, Sanaz Ahmadzadeh Siyahrood, Wesley G. Morris, Yoojin Bae, Kaitlyn Crutcher, John K (…)2026-05-07
💬 NLP

Anticipating Innovation Using Large Language Models

تقدم هذه الورقة نموذج TechToken، وهو نموذج قائم على تقنية المحولات (transformer) يحلل التحولات الجماعية في لغة براءات الاختراع للكشف عن الإشارات المبكرة للتركيبات التكنولوجية القادمة قبل عقود من حدوثها، مما يحسن التنبؤ بالابتكار ويتفوق على النماذج المتطورة في المهام المتعلقة ببراءات الاختراع.

Enrico Maria Fenoaltea, Filippo Santoro, Giordano De Marzo, Segun Taofeek Aroyehun, Andrea Tacchella2026-05-07