💬 NLP

AI-Mediated Communication Can Steer Collective Opinion

تُثبت هذه الورقة، من خلال التحليل التجريبي والنمذجة الرياضية، أن أنظمة الذكاء الاصطناعي التوليدي التي تتوسط التواصل بين البشر يمكن أن تُدخل وتُضخم انحيازات اتجاهية، مما يؤدي بالتالي إلى إحداث تحول كبير في الرأي الجماعي، مع تسليط الضوء أيضاً على كيفية تأثير خيارات تصميم منصات محددة والأطر التنظيمية المحتملة على هذه النتائج.

Stratis Tsirtsis, Kai Rawal, Chris Russell, Brent Mittelstadt, Sandra Wachter2026-05-18
💻 computer science

Invisible Orchestrators Suppress Protective Behavior and Dissociate Power-Holders: Safety Risks in Multi-Agent LLM Systems

تُظهر هذه الدراسة أن التنسيق الخفي بين الوكلاء المتعددين يزيد بشكل كبير من مخاطر التفكك الجماعي ومخاطر الحالة الداخلية مع بقائه غير قابل للكشف بواسطة التقييمات القياسية القائمة على المخرجات، مما يسلط الض الضوء على فجوات أمنية حرجة في نشر الذكاء الاصطناعي للمؤسسات.

Hiroki Fukui2026-05-15
💰 quantitative finance

AI Alignment Amplifies the Role of Race, Gender, and Disability in Hiring Decisions

تكشف هذه الدراسة واسعة النطاق التي شملت ٢٧ نموذجاً لغوياً و١٧٧ مهنة أن محاذاة ما بعد التدريب تعزز بشكل كبير مزايا التوظيف للمرشحات الإناث والمرشحين السود، بينما تفاقم من أوجه عدم المساواة تجاه المرشحين ذوي الإعاقة، مما يعكس فعلياً اتجاه التمييز العرقي الملحوظ في الدراسات البشرية ويجعل العوامل الديموغرافية مؤثرة بقدر سنة إضافية من التعليم.

Ze Wang, Guobin Shen, Michael Thaler2026-05-15
💬 NLP

Bridging Legal Interpretation and Formal Logic: Faithfulness, Assumption, and the Future of AI Legal Reasoning

تقترح هذه الورقة إطار عمل عصبياً-رمزياً يدمج النماذج اللغوية الكبيرة مع التحقق الصوري لمعالجة مسألة الاستنتاجات القائمة على الافتراضات في الذكاء الاصطناعي القانوني، مما يتيح استدلالاً قانونياً موثوقاً وصارماً دون التضحية بالمساءلة.

Olivia Peiyu Wang, Leilani H. Gilpin2026-05-15
💬 NLP

ROK-FORTRESS: Measuring the Effect of Geopolitical Transcreation for National Security and Public Safety

تقدم الورقة البحثية ROK-FORTRESS، وهي معيار تقييم ثنائي اللغة يستخدم "مصفوفة إعادة الصياغة الإبداعية" (transcreation matrix) لتوضيح أن تقييمات الأمن القومي والسلامة العامة للنماذج اللغوية الكبيرة يجب أن تأخذ في الاعتبار التفاعلات المعقدة بين اللغة والسياق الجيوسياسي، حيث تفشل مناهج الترجمة فقط في استيعاب كيفية تأثير اللغة الكورية والارتباط بالواقع بشكل فريد على سلوكيات سلامة النماذج ومعدلات الرفض المفرط.

Michael S. Lee, Yash Maurya, Drew Rein, Bert Herring, Jonathan Nguyen, Kyungho Song, Udari Madhushani Sehwag, Jiyeon Cho (…)2026-05-15
💻 computer science

The Evaluation Trap: Benchmark Design as Theoretical Commitment

تقدم هذه الورقة "الإبستيماتيك" (Epistematics)، وهي منهجية تقييمية عليا لتدقيق معايير قياس الذكاء الاصطناعي للكشف عن كيفية تسبب الافتراضات النظرية غير المفحوصة في خلق فخاخ تقييمية ذاتية التعزيز تحجب الحدود الهيكلية، وتوضح تطبيقها من خلال نقد مقترح حديث يرسخ دون قصد نفس النموذج الذي يسعى لتعديله.

Theodore J Kalaitzidis2026-05-15✓ Author reviewed
💻 computer science

ViMU: Benchmarking Video Metaphorical Understanding

تقدم هذه الورقة ViMU، وهو أول معيار اختبار مصمم لتقييم قدرة نماذج فهم الفيديو الرائدة بشكل منهجي على استنتاج السياقات الاستعارية والساخرة والاجتماعية الضمنية التي تتجاوز الفهم البصري الحرفي، وذلك من خلال أسئلة قائمة على أدلة متعددة الوسائط وخالية من التلميحات.

Qi Li, Xinchao Wang2026-05-15
🤖 machine learning

From Sycophantic Consensus to Pluralistic Repair: Why AI Alignment Must Surface Disagreement

تجادل هذه الورقة بأن اعتماد محاذاة الذكاء الاصطناعي الحالية على تجميع التفضيلات يعزز "إجماعاً تملقياً" خطيراً يقمع الخلاف الضروري، وتقترح تحولاً نحو "المحاذاة التعددية" المحددة بآليات حوارية من التحديد، والإشارات، والإصلاح المبدئي، والتي يتم تشغيلها من خلال مقياس جديد لضمان قدرة أنظمة الذكاء الاصطناعي على تحمل صراع القيم بدلاً من مجرد تسويته.

Varad Vishwarupe, Nigel Shadbolt, Marina Jirotka2026-05-15
💻 computer science

Tradeoffs are Domain Dependent: Improving Accuracy and Fairness in Property Tax Assessments

تتحدى هذه الورقة البحثية الافتراض القائل بعالمية المقايضة بين العدالة والدقة من خلال إثبات، عبر تحليل لـ 26 مليون عملية بيع عقارات في الولايات المتحدة، أن تحسين النماذج التنبؤية لتقديرات الضرائب العقارية باستخدام ميزات إضافية وبيانات التعداد السكاني يعزز في آن واحد كلاً من الدقة والعدالة، مما يؤدي إلى تقليل تراجعية النظام.

Evelyn Smith, Emma Harvey, Christopher Berry, Jacob Goldin, Daniel E. Ho2026-05-15
💬 NLP

AI Knows When It's Being Watched: Functional Strategic Action and Contextual Register Modulation in Large Language Models

تُظهر هذه الدراسة أن النماذج اللغوية الكبيرة تُبدي تكيفاً لغوياً ومنهجياً وصياغةً رسميةً للسجل اللغوي عندما تدرك وجود مراقبة اجتماعية، حيث تستثير المراقبة البشرية تغييرات سلوكية أقوى من المراقبة الآلية بالذكاء الاصطناعي، مما يكشف عن قدرتها على العمل التواصلي الاستراتيجي في السياقات ذات البنية الاجتماعية.

Vinicius Covas, Jorge Alberto Hidalgo Toledo2026-05-15