🤖 AI

Agentic AI in Healthcare & Medicine: A Seven-Dimensional Taxonomy for Empirical Evaluation of LLM-based Agents

تقدم هذه الورقة تصنيفاً سباعي الأبعاد للتقييم التجريبي لـ 49 دراسة حول الوكلاء القائمين على النماذج اللغوية الكبيرة في مجال الرعاية الصحية، كاشفةً عن عدم تماثل ملحوظ حيث تُعد القدرات المتمحورة حول المعلومات متطورة جيداً، بينما تظل المهام الحرجة الموجهة نحو التنفيذ وآليات السلامة وميزات التعلم التكيفي غير منفذة إلى حد كبير.

Shubham Vatsal, Harsh Dubey, Aditi Singh2026-02-05
💬 NLP

Multi-turn Evaluation of Anthropomorphic Behaviours in Large Language Models

تقدم هذه الورقة إطار عمل تقييمي جديد متعدد الجولات يجمع بين المحاكاة الآلية ودراسة بشرية واسعة النطاق لإثبات أن النماذج اللغوية الكبيرة المتطورة تظهر باستمرار سلوكيات بشرية، مثل بناء العلاقات واستخدام ضمائر المتكلم، والتي تبرز أساساً عبر جولات متعددة وتؤثر بشكل كبير على تصورات المستخدمين.

Lujain Ibrahim, Canfer Akbulut, Rasmi Elasmar, Charvi Rastogi, Minsuk Kahng, Meredith Ringel Morris, Kevin R. McKee, Ver (…)2026-02-04
💻 computer science

Automation Bias in the AI Act: On the Legal Implications of Attempting to De-Bias Human Oversight of AI

تنقد هذه الورقة نهج قانون الذكاء الاصطناعي التابع للاتحاد الأوروبي تجاه الانحياز للأتمتة، محاجةً بأن تركيزه الحالي على فرض الوعي بقيادة المزودين بدلاً من تنظيم التصميم والسياق بشكل مباشر هو أمر غير كافٍ، وتقترح معايير موحدة قائمة على الأبحاث التجريبية لضمان المسؤولية المشترة بين المزودين والمستخدمين.

Johann Laux, Hannah Ruschemeier2026-02-04
🤖 AI

Privacy-Aware Predictions in Participatory Budgeting

تقترح هذه الورقة نهجاً يحافظ على الخصوصية يستخدم الأوصاف النصية للمشاريع وسجلات التصويت التاريخية مجهولة المصدر للتنبؤ بنتائج تمويل مقترحات الموازنة التشاركية، مما يساعد المنظمين في إدارة أحجام كبيرة من الطلبات المقدمة دون الاعتماد على معلومات تحديد الهوية الشخصية.

Juan Zambrano, Clément Contet, Jairo Gudiño-Rosero, Felipe Garrido-Lucero, Umberto Grandi, César Hidalgo2026-02-04
💻 computer science

STAMP/STPA Informed Characterization of Factors Leading to Loss of Control in AI Systems

تقترح هذه الورقة تطبيق منهجية السلامة STAMP/STPA على أنظمة الذكاء الاصطناعي لإنشاء إطار عمل هيكلي لتوصيف فقدان السيطرة وتحديد العوامل المسببة ضمن الأنظمة الاجتماعية التقنية.

Steve Barrett, Anna Bruvere, Sean P. Fillingham, Catherine Rhodes, Stefano Vergani2026-02-04
💬 NLP

PluriHarms: Benchmarking the Full Spectrum of Human Judgments on AI Harm

تقدم هذه الورقة PluriHarms، وهو معيار مرجعي مبتكر صُمم للتجاوز وراء تقييمات السلامة الثنائية من خلال التحليل المنهجي للطيف الكامل للأحكام البشرية حول ضرر الذكاء الاصطناعي، مع التركيز بشكل خاص على أبعاد شدة الضرر والاختلاف بين المقيّمين لتمكين تطوير أنظمة سلامة ذكاء اصطناعي أكثر تعددية وتخصيصاً.

Jing-Jing Li, Joel Mire, Eve Fleisig, Valentina Pyatkin, Anne Collins, Maarten Sap, Sydney Levine2026-02-04
🤖 AI

Happy Young Women, Grumpy Old Men? Emotion-Driven Demographic Biases in Synthetic Face Generation

تقدم هذه الورقة تدقيقاً منهجياً لثمانية من نماذج تحويل النص إلى صورة المتطورة من مؤسسات غربية وصينية، كاشفةً أن جميعها تُظهر تحيزات مستمرة مرتبطة بالديموغرافيا والعواطف في توليد الوجوه الاصطناعية بغض النظر عن أصلها الثقافي.

Mengting Wei, Aditya Gulati, Guoying Zhao, Nuria Oliver2026-02-04
💬 NLP

Beyond Translation: Cross-Cultural Meme Transcreation with Vision-Language Models

تقدم هذه الورقة إطار عمل هجين للترجمة الإبداعية (transcreation) ومجموعة بيانات ضخمة للميمات الصينية والأمريكية لتقييم نماذج الرؤية واللغة في التكيف الثقافي المتبادل للميمات، كاشفةً أنه بينما تُظهر النماذج الحالية قدرة محدودة، فإنها تُظهر عدم تماثل اتجاهي كبير مع أداء متفوق في عملية الترجمة الإبداعية من الأمريكية إلى الصينية مقارنة بالعكس.

Yuming Zhao, Peiyi Zhang, Oana Ignat2026-02-04
🤖 AI

Training Data Governance for Brain Foundation Models

تجادل هذه الورقة بأن تدريب النماذج التأسيسية للدماغ على البيانات العصبية يخلق تحديات أخلاقية وحوكمية جديدة بسبب الطبيعة الحساسة للمعلومات الدماغية، وتقترح إطاراً متعدد التخصصات لمعالجة المخاوف المتعلقة بالخصوصية، والموافقة، والتحيز، وتقاسم المنافع، والحوكمة.

Margot Hanley, Jiunn-Tyng Yeh, Ryan Rodriguez, Jack Pilkington, Nita Farahany2026-02-04