💬 NLP

Do Chinese models speak Chinese languages?

تكشف هذه الدراسة أنه على الرغم من المشهد اللغوي المتنوع في الصين، فإن نماذجها اللغوية الكبيرة ذات الأوزان المفتوحة تظهر ملفات أداء متعددة اللغات مشابهة بشكل صارخ للنماذج الغربية — حيث تتفوق في اللغات العالمية الرئيسية مثل الماندرين والفرنسية والألمانية بينما تخفق غالباً في دعم لغات الأقليات مثل الكازاخية والأويغورية — مما يشير إلى أن ممارسات القياس العالمي وموارد التدريب المشتركة تدفع نحو تجانس قدرات اللغة على حساب الأولويات المحلية.

Andrea W Wen-Yi, Unso Eun Seo Jo, David Mimno2026-05-18
💰 quantitative finance

From Model Design to Organizational Design: Complexity Redistribution and Trade-Offs in Generative AI

تقدم هذه الورقة إطار عمل "العمومية-الدقة-البساطة" (GAS) لتجادل بأنه في حين يوفر الذكاء الاصطناٍ التوليدي بساطةً للمستخدم، فإنه في الواقع يعيد توزيع التعقيد على البنية التحتية التنظيمية والكوادر البشرية، مما يجعل الميزة التنافسية معتمدة على إتقان هذا التحول من خلال التصميم الاستراتيجي بدلاً من مجرد التبني.

Sharique Hasan, Alexander Oettl, Sampsa Samila2026-05-18
💻 computer science

How to Stop Playing Whack-a-Mole: Mapping the Ecosystem of Technologies Facilitating AI-Generated Non-Consensual Intimate Images

تتناول هذه الورقة الطبيعة المجزأة ورد الفعل في الجهود الحالية لمكافحة الصور الحميمة غير الرضائية المولدة بواسطة الذكاء الاصطناعي (AIG-NCII) من خلال تقديم أول تصنيف شامل للنظام البيئي التكنولوجي الذي يحدد ١١ فئة من التقنيات الميسرة، مما يوفر إطاراً مشتركاً لتقييم التدخلات، وتحليل المشاهد السياساتية، وتوجيه الأبحاث المستقبلية بوضوح واستشراف أكبر.

Michelle L. Ding, Harini Suresh, Suresh Venkatasubramanian2026-05-18
🤖 AI

MESD: A Risk-Sensitive Metric for Explanation Fairness Across Intersectional Subgroups

تقدم هذه الورقة مقياس تفاوت استقرار التفسير متعدد الفئات (MESD)، وهو مقياس حساس للمخاطر يحدد كمياً تفاوتات العدالة الإجرائية عبر المجموعات الفرعية التقاطعية من خلال دمج التجميع المدرك للتسميات، والانكماش التجريبي-بايزي، وتوزين القيمة المتوقعة المشروطة (CVaR)، وتبرهن على فعاليته ضمن إطار تحسين متعدد الأهداف (UEF) للكشف عن قضايا العدالة غير المرئية للمقاييس التقليدية الموجهة نحو النتائج.

Gideon Popoola, John Sheppard2026-05-18
🤖 machine learning

GESD: Beyond Outcome-Oriented Fairness

تقدم هذه الورقة البحثية مقياس GESD، وهو مقياس للعدالة موجه نحو الإجراءات يحدد كمياً التفاوتات في استقرار ومتانة تفسيرات النموذج عبر المجموعات الفرعية، وتدمجه في إطار عمل متعدد الأهداف يسمى FEU لتحسين المنفعة، والعدالة القائمة على النتائج، والعدالة القائمة على التفسير بشكل مشترك.

Gideon Popoola, John Sheppard2026-05-18
💻 computer science

GreenZ: A Sustainable UX Framework for Complex Digital Systems

تقدم هذه الورقة GreenZ، وهو إطار عمل لتجربة المستخدم المستدامة ثلاثي الطبقات للأنظمة الرقمية المعقدة يعالج النفايات الرقمية والعبء المعرفي من خلال فلسفة تقوم على عشرة مبادئ، وخمسة أنظمة تشغيلية، وأدوات عملية، ترتكز على تصنيف جديد للنفايات الرقمية ونموذج قرار كفاية الذكاء الاصطناعي.

Trisha Solanki2026-05-18
💻 computer science

Validated Hypotheses as a Lens for Human-Likeness Evaluation in AI Agents

تقدم هذه الورقة HumanStudy-Bench، وهو إطار تقييم يقيس مدى قدرة الوكلاء القائمين على النماذج اللغوية الكبيرة على محاكاة السلوك البشري من خلال قياس قدرتهم على تكرار النتائج والأنماط الاستدلالية المعتمدة في العلوم الاجتماعية من المجتمعات البشرية، مما يكشف أن تصميم الوكيل يؤثر على التوافق بشكل أكبر من حجم النموذج.

Xuan Liu, HaoYang Shang, Zizhang Liu, Yuanjun Feng, Guankai Zhai, Yunze Xiao, Yiwen Tu, Haojian Jin2026-05-18
🔬 physics

Bridging the climate to energy data gap: simulated annealing for representative climate year selection

تقترح هذه الدراسة وتتحقق من صحة طريقة تحسين تعتمد على التلدين المحاكي، باستخدام مسافة واسرشتاين المقطعة موسمياً، لاختيار مجموعات فرعية تمثيلية للغاية من السنوات المناخية من المجموعات الكبيرة، وهو ما يتفوق بشكل كبير على الممارسات الحالية والخوارزميات البديلة لتوفير مدخلات قوية وغير منحازة لنمذجة نظم الطاقة.

Bram van Duinen, Karin van der Wiel, Jean Thorey, Laurens Stoop2026-05-18✓ Author reviewed
🤖 AI

Formal Methods Meet LLMs: Auditing, Monitoring, and Intervention for Compliance of Advanced AI Systems

تقترح هذه الورقة إطار عمل هجين يجمع بين الأساليب الصورية (تحديداً منطق الزمن الخطي) والتعلم الآلي لتمكين التدقيق الفعال دون اتصال بالإنترنت والمراقبة في وقت التشغيل لأنظمة الذكاء الاصطناًعي ذات الصندوق الأسود، مما يثبت أن هذه التقنيات تتفوق على النماذج المرجعية للنماذج اللغوية الكبيرة في اكتشاف انتهاكات القيود الزمنية ويمكنها التخفيف من المخاطر بنشاط مع الحفاظ على أداء المهام.

Parand A. Alamdari, Toryn Q. Klassen, Sheila A. McIlraith2026-05-18
💻 computer science

Inside Baseball: The Automated Ball-Strike System as an Object Lesson in Technological Rule Enforcement

تستخدم هذه الورقة صراع دوري البيسبول الرئيسي لمدة سبع سنوات لتنفيذ نظام الكرات والضربات الآلي (ABS) كدراسة حالة لإثبات أن حتى القواعد التي تبدو واضحة تتطلب ترجمة اجتماعية تقنية معقدة بسبب "الحقيقة الأرضية" المتنازع عليها والحاجة إلى موازنة قيم أصحاب المصلحة المتنوعة، مما يتحدى نماذج التقييم التقليدية لصالح النهج الموجه نحو الممارسة.

Andrea Wen-Yi Wang, Waki Kamino, David Mimno, Karen Levy, Malte F. Jung2026-05-18