💬 NLP

When Symptoms Are Not Enough: Evidence-Weighting Patterns in Large Language Model Psychiatric Screening

تقيم هذه الدراسة أداء خمسة من نماذج اللغات الكبيرة المتطورة على معيار مرجعي مرتكز على مقابلة التشخيص والاختبار الهيكلي (SCID) لـ 555 مقابلة نفسية، كاشفةً أنه في حين تُظهر نماذج مثل GPT-4.1 وGPT-5 Mini إمكانات واعدة للفحص القابل للتوسع، فإن ميلها إلى استبعاد أدلة الأعراض الصريحة عند وجود وظائف محفوظة أو سياقات وقائية يؤدي إلى أخطاء سلبية كاذبة كبيرة وتفاوتات ديموغرافية يجب معالجتها قبل النشر السريري.

Jianfeng Zhu, Megan Korhummel, Ruoming Jin, Karin G. Coifman2026-05-25
💻 computer science

Cognitive offloading and the speedup illusion in human-AI interaction

تكشف دراسة واسعة النطاق أن المستخدمين يعانون من "وهم تسارع" عند التفاعل مع الذكاء الاصطناعي، حيث يبالغون بشكل كبير في تقدير توفير الوقت ويقللون من تقدير الجهد المطلوب للمهام المدعومة بالذكاء الاصطناعي مقارنة بالعمل المستقل، على الرغم من بقاء أوقات الإنجام الفعلية دون تغيير.

Sunny Yu, Myra Cheng, Ahmad Jabbar, Ilia Sucholutsky, Katherine M. Collins, Dan Jurafsky, Robert D. Hawkins2026-05-25
🤖 machine learning

Assessing Predictive Models for Fairness Based on Movement Patterns

تقترح هذه الورقة إطار عمل مبتكر لتقييم عدالة النماذج التنبؤية من خلال توسيع مفاهيم العدالة المكانية التقليدية لتشمل أنماط الحركة الفردية عبر مناطق جغرافية متعددة، وذلك باستخدام إحصاءات المسح المكاني للكشف عن التحيزات القائمة على الحركة وتحديد مواقعها بفعالية.

Francesco Lettich, Mario A. Nascimento, Chiara Pugliese, Chiara Renso2026-05-25
💻 computer science

IyàwóBench: A Benchmark for Evaluating Large Language Model Clinical Triage Accuracy on Undifferentiated Febrile Illness in Nigerian Primary Health Settings

تقدم الورقة البحثية IyàwóBench، وهو أول معيار لتقييم النماذج اللغوية الكبيرة في الفرز السريري لحالات الحمى غير المحددة في الرعاية الأولية النيجيرية، والذي كشف عن أنه بينما تُظهر النماذج الحديثة سلامة عالية من خلال تجنب التخفيضات الخطيرة في تقدير الحالة، فإن دقتها التشخيصية تتباين بشكل كبير وتتحسن بشكل جوهري عبر الأنظمة المصممة خصيصاً وفقاً لإرشادات منظمة الصحة العالمية.

Anthonio Oladimeji Gabriel, Dimeji Abdulsobur Olawuyi, Oloruntoba Ajayi, Temiloluwa Aderemi2026-05-25
💻 computer science

Synthetic Sources?: Auditing Generative Search Engine Citations for Evidence of AI-Generated Sources

تدقق هذه الورقة أربعة محركات بحث توليدية رئيسية باستخدام 712 استعلاماً من واقع الحياة، وتجد أن ما يقرب من 16% من مصادرها المستشهد بها هي مصادر مُنشأة بواسطة الذكاء الاصطناعي، مما يسلط الضوء على خطر كبير يتمثل في تلقي المستخدمين لمعلومات اصطناعية غير موثقة تُقدم على أنها موثوقة.

Mowafak Allaham, Nicholas Diakopoulos2026-05-25
💻 computer science

Inferential Privacy Leakage in Anonymized Conversational AI Logs

يكشف تحليل لسجلات محادثات الذكاء الاصطناዊ التوليدي مجهولة المصدر لأكثر من 1,000 مستخدم في أربع دول من دول الجنوب العالمي أنه على الرغم من إزالة معلومات تحديد الهوية الشخصية الصريحة، لا تزال النماذج اللغوية الكبيرة قادرة على استنتاج ديموغرافيات حساسة مثل العمر والجنس والبلد بدقة من خلال جولات المحادثة الأولى عبر الاستفادة من الصور النمطية المتكررة، مما يثبت أن إزالة معلومات تحديد الهوية الشخصية على مستوى الرسالة غير كافية لحماية خصوصية المستخدم.

S M Mehedi Zaman, Kiran Garimella2026-05-25
💻 computer science

Reddit's Appetite: Predicting User Engagement with Nutritional Content

تحلل هذه الدراسة ما يقرب من نصف مليون منشور من منشورات الطعام على موقع "ريديت" لتثبت أن دمج الميزات الغذائية، ولا سيما الكثافة السعرية، يحسن بشكل كبير من التنبؤ بتفاعل المستخدمين (التعليقات) بنسبة تقارب 5%، مما يشير إلى أن المحتوى الغني غذائياً يلقى صدىً أقوى لدى المجتمعات عبر الإنترنت.

Gabriela Ozegovic, Thorsten Ruprechter, Denis Helic2026-05-22
💻 computer science

Tracing the Techno-Supremacy Doctrine: A Critical Discourse Analysis of the AI Executive Elite

تستخدم هذه الورقة تحليلاً نقدياً للخطاب على مرحلتين لـ 14 نصاً من قِبل مسؤولين تنفيذيين في مجال الذكاء الاصطناعي من عام 2017 إلى عام 2025 لتحديد وتشخيص "عقيدة التفوق التكنولوجي"، كاشفةً عن سردية مستقطبة ولكنها مهيمنة تؤطر التكنولوجيا باعتبارها حلاً حتمياً ومتفوقاً للمشكلات المجتمعية مع التقليل استراتيجياً من المخاطر، مقدمةً في نهاية المطاف إطاراً لتعزيز الوعي النقدي بين أصحاب المصلحة.

Héctor Pérez-Urbina2026-05-22
🔢 mathematics

Two thousand years of the oracle problem. Insights from Ancient Delphi on the future of blockchain oracles

تجسّر هذه الورقة الفجوة بين الاستعلامات الدلفية القديمة وأوراكل البلوكشين الحديثة من خلال تطوير إطار عمل مقارن وتحليل الاستعلامات الدلفية لاقتراح استراتيجيات لتعزيز موثوقية وأمن أوراكل البلوكشين اللامركزية.

Giulio Caldarelli, Massimiliano Ornaghi2026-05-22
💻 computer science

The Ephemeral Web and the Case for Proactive Archiving

بالاستناد إلى دراسة حالة لمدرسة وكلية سفارة باكستان الدولية في طهران وتجارب المؤلف الشخصية مع الهشاشة الرقمية، تجادل هذه الورقة بأن الأرشفة الاستباقية المؤتمتة يجب أن تصبح مكونًا قياسيًا لصيانة المواقع الإلكترونية لمواجهة الطبيعة الزائلة للهيكل الشبكي والحفاظ على الذاكرة المؤسسية.

Meliksah Yorulmazlar2026-05-22