💻 computer science

Multi-Agent Strategic Games with LLMs

تقدم هذه الورقة إطاراً منهجياً يستخدم النماذج اللغوية الكبيرة كخاضعة للتجربة في ألعاب معضلة أمنية متكررة لإثبات أنها تعيد إنتاج الآليات الرئيسية للعلاقات الدولية بشكل منهجي — مثل زيادة الصراع في ظل تعدد الأقطاب، والانهيار في الآفاق المحدودة، والحد من الصراع من خلال التواصل — مع توفير وصول فريد إلى الاستدلال الاستراتيجي وراء خياراتها.

Maxim Chupilkin2026-05-06
💻 computer science

EQUITRIAGE: A Fairness Audit of Gender Bias in LLM-Based Emergency Department Triage

تُراجع دراسة EQUITRIAGE خمسة نماذج لغوية كبيرة في ما يقرب من 375,000 سيناريو لفرز الحالات في أقسام الطوارئ، وتكشف أن جميع النماذج تظهر تحيزاً جنسياً بمعدلات انقلاب تتجاوز 5%، مما يثبت أن مقاييس العدالة مثل التكافؤ الجماعي، والثبات المقابل للواقع، والمعايرة هي خصائص متميزة تتطلب تدقيقاً خاصاً بكل نموذج قبل النشر السريري.

Richard J. Young, Alice M. Matthews2026-05-06
💻 computer science

How Sovereign Is Sovereign Compute? A Review of 775 Non-U.S. Data Centers

من خلال تحليل مجموعة بيانات جديدة تضم 775 مشروعاً لمراكز بيانات خارج الولايات المتحدة، تكشف هذه الورقة أن الشركات الأمريكية تسيطر على ما يقرب من نصف سعة الحوسبة العالمية خارج الولايات المتحدة من حيث قيمة الاستثمار، مما يشير إلى أن المشغلين الأجانب يمكن أن يعملوا كرافعة تنظيمية لحوكمة الذكاء الاصطناعي، مع تسليط الضوء في الوقت نفسه على أن البنية التحتية المحلية وحدها لا تضمن السيادة الرقمية إذا كانت تُدار من قبل كيانات أجنبية.

Aris Richardson, Haley Yi, Michelle Nie, Simon Wisdom, Casey Price, Ruben Weijers, Steven Veld, Mauricio Baker2026-05-05
💻 computer science

LLM-based uncertainty assessment of social media situational signals for crisis reporting

تقترح هذه الورقة إطار عمل مدركاً لعدم اليقين يستفيد من النماذج اللغوية الكبيرة والبيانات الوكيلة الخارجية لتقييم مدى معقولية الادعاءات على وسائل التواصل الاجتماعي، مما يتيح توليد تقارير أزمات توضح صراحةً مستويات الثقة للمساعدة في اتخاذ القرار البشري أثناء الكوارث.

Timothy Douglas, Roben Delos Reyes, Asanobu Kitamoto2026-05-05
💻 computer science

Generative-AI and the transformation of workforce. A job postings-driven analysis

تحلل هذه الورقة أكثر من 150,000 إعلان وظيفي من عام 2018 إلى عام 2025 لتثبت أن الذكاء الاصطناዊ التوليدي يعمل في المقام الأول كقوة تعزيزية، مما يدفع نحو تحول هيكلي في القوى العاملة باتجاه خبرة هجينة بين البشر والذكاء الاصطناعي تتميز بارتفاع الطلب على المهارات المتخصصة في الذكاء الاصطناعي والمهارات الناعمة العليا إلى جانب انخفاض المهام الروتينية.

Diana Maria Popa, Simona-Vasilica Oprea, Adela Bâra2026-05-05
💻 computer science

The Oracle's Fingerprint: Correlated AI Forecasting Errors and the Limits of Bias Transmission

تكشف هذه الورقة أنه في حين تُظهر ثلاثة نماذج لغوية كبيرة تم تطويرها بشكل مستقل أخطاءً تنبؤية عالية الارتباط تخلق "أحادية ثقافية معرفية"، فإن هذا التحيز المشترك لم ينتقل بعد إلى المتنبئين البشر، الذين يستمرون بدلاً من ذلك في الاعتماد على تحيزاتهم المسبقة وتحديثاتهم العقلانية نحو الحقيقة الأرضية.

Theodor Spiro2026-05-05
💬 NLP

Can AI Debias the News? LLM Interventions Improve Cross-Partisan Receptivity but LLMs Overestimate Their Own Effectiveness

بينما تستطيع النماذج اللغوية الكبيرة تحسين تقبل القراء المحافظين للأخبار الليبرالية بفعالية من خلال إعادة الصياغة الجوهرية بدلاً من مجرد التغييرات اللفظية، إلا أنها تبالغ بشكل كبير في تقدير حجم تأثيرها وتخطئ في تحديد العوامل النفسية التي تدفع الاستجابة البشرية، مما يسلط الض الضوء على الحاجة إلى الإشراف البشري في جهود إزالة الانحياز التي يقودها الذكاء الاصطناعي.

Faisal Feroz, Jonas R. Kunst2026-05-05
💻 computer science

The Hidden Cost of Thinking: Energy Use and Environmental Impact of LMs Beyond Pretraining

تكشف هذه الورقة أن الأثر البيئي لتطوير النماذج اللغوية الحديثة تهيمن عليه تجارب ما بعد التدريب ومسارات الاستدلال المعقدة —التي تشكل 82.2% من إجمالي الحوسبة وتجعل نماذج الاستدلال أكثر تكلفة في مرحلة ما بعد التدريب بمقدار 17 مرة مقارنة بالنماذج المضبوطة بالتعليمات— مما يسلط الض الضوء على فجوة حرجة غير مُبلغ عنها في معايير التقارير البيئية الحالية.

Jacob Morrison, Noah A. Smith, Emma Strubell2026-05-05
💻 computer science

Computational Challenges in Scaling Democratic Deliberation

تحدد هذه الورقة الوظائف الجوهرية المطلوبة لبرمجيات الديمقراطية الرقمية لدعم المداولات واسعة النطاق، مع تحديد التحديات الحسابية الجديدة والحلول الخوارزمية اللازمة لمعالجتها، مع وضع هذه المشكلات ضمن سياق أبحاث علوم الحاسوب والذكاء الاصطناعي الحالية.

Davide Grossi2026-05-05
🤖 machine learning

From Packets to Patterns: Interpreting Encrypted Network Traffic as Longitudinal Behavioral Signals

تُثبت هذه الورقة أن حركة مرور شبكة الهواتف الذكية المشفرة، عند تحليلها من خلال نماذج المحولات (transformer-based models) والمشفرات التلقائية المتناثرة (sparse autoencoders)، يمكنها رصد أنماط سلوكية طولية متميزة تتعلق بالتوتر والوحدة واضطرابات النوم بشكل سلبي وقابل للتفسير، مما يكشف عن ديناميكيات داخل الشخص تفتقدها سمات حركة المرور التقليدية.

Rameen Mahmood, Omar El Shahawy, Souptik Barua, Zachary Beattie, Jeffrey Kaye, Xuhai "Orson'' Xu, Danny Yuxing Huang2026-05-05