🤖 AI

The Case for ESM3 as a General-Purpose AI Model with Systemic Risk Under the EU AI Act

تجادل هذه الورقة بأنه في حين ينبغي تنظيم النماذج البيولوجية التأسيسية مثل ESM3، من الناحية المثالية، باعتبارها نماذج ذكاء اصطناعي عامة ذات مخاطر نظامية بموجب قانون الذكاء الاصطناعي للاتحاد الأوروبي للتخفيف من مخاطر الاستخدام المزدوج البيولوجي، فإن الغموض الحالي في التشريعات يعني أنها غير مغطاة بشكل ملموس، مما يدفع المؤلفين إلى اقتراح حلول محددة لسد هذه الفجوة التنظيمية.

Taro Qureshi, Jacob Griffith, Koen Holtman, Marcel Mir Teijeiro, Ze Shen Chin, Rokas Gipiškis2026-05-06
🤖 AI

Model Routing as a Trust Problem: Route Receipts for Adaptive AI Systems

تقترح هذه الورقة "إيصال المسار"، وهو أثر شفافية وقت التشغيل المدمج الذي يوثق قرارات التوجيه المحددة (مثل إصدار النموذج، أو الفئة، أو المنطقة) المستخدمة لإنشاء استجابة الذكاء الاصطناعي، مما يتيح ثقة المستخدم والمساءلة دون الكشف عن التفاصيل الداخلية المملوكة للنظام.

Vincent Schmalbach2026-05-06
🤖 AI

Are LLMs More Skeptical of Entertainment News?

تكشف هذه الورقة أن نماذج لغوية كبيرة معينة تُظهر تشككاً خاصاً بنوع أدبي معين تجاه أخبار الترفيه المشروعة، حيث تصنفها كأخبار مزيفة بمعدل أكبر من الأخبار الجادة بسبب تحيزات ضد الشرعية المعرفية لهذا النوع الأدبي بدلاً من السمات الأسلوبية، مما يسلط الضوء على الحاجة إلى تقييم مُصنف حسب النوع في تقدير المصداقية الآلي.

Huiqian Lai2026-05-06
🤖 AI

Principles and Guidelines for Randomized Controlled Trials in AI Evaluation

تضع هذه الورقة إطاراً تأسيسياً لتوحيد معايير التجارب العشوائية المنضبطة في تقييم الذكاء الاصطناعي عبر تكييف نموذج الصلاحية الرباعي لـ "شاديش وآخرون" وإرشادات (TOP) إلى خمسة مبادئ و33 إرشاداً تشغيلياً تعطي الأولوية للأداء البشري، والاستدلال السببي، والشفافية لمعالجة التحديات الفريدة في دراسات التفاعل بين الإنسان والذكاء الاصطناعي.

Christopher Kelly, Angelica Chowdhury, Alexandra Campili, Bimpe Ayoola, Devin Barbour, Thomas Chen Dawson, Ze Shen Chin (…)2026-05-06
🤖 AI

AcademiClaw: When Students Set Challenges for AI Agents

تقدم هذه الورقة AcademiClaw، وهو معيار تقييم ثنائي اللغة يتكون من 80 مهمة أكاديمية واقعية ومعقدة تم اختيارها من أعمال الطلاب لتقييم وتشخيص أوجه القصور في وكلاء الذكاء الاصطناعي الحاليين في التعامل مع التحديات طويلة المدى ومتعددة المجالات، مما كشف أن حتى النماذج الرائدة لا تحقق سوى معدل نجاح بنسبة 55%.

Junjie Yu, Pengrui Lu, Weiye Si, Hongliang Lu, Jiabao Wu, Kaiwen Tao, Kun Wang, Lingyu Yang, Qiran Zhang, Xiuting Guo, X (…)2026-05-06
📈 economics

Human-Provenance Verification should be Treated as Labor Infrastructure in AI-Saturated Markets

تجادل الورقة بأن الذكاء الاصطناعي، من خلال تحويل المهام الإدراكية المعيارية إلى سلع وتشكيل اقتصاد "الباربل" (المنحني)، يجعل من ضرورة إرساء التحقق من المصدر البشري بنية تحتية أساسية للعمل لدعم القيمة السوقية الناشئة للأعمال التي يكون فيها الحضور البشري جوهرياً لا عرضياً.

Erin McGurk, David Khachaturov2026-05-06
🤖 machine learning

Moral Sensitivity in LLMs: A Tiered Evaluation of Contextual Bias via Behavioral Profiling and Mechanistic Interpretability

تقدم هذه الورقة مؤشر حساسية أخلاقية متعدد المستويات لتقييم التحيز السياقي في النماذج اللغوية الكبيرة، مما يكشف عن بصمات سلوكية متميزة عبر البنيات المختلفة ويثبت آلياً أن تقطير الاستدلال يمكن أن يؤدي دون قصد إلى إعادة تنشيط دوائر التحيز الإجرامي رغم زيادة القدرة.

Yash Aggarwal, Atmika Gorti, Vinija Jain, Aman Chadha, Krishnaprasad Thirunarayan, Manas Gaur2026-05-06
⚡ electrical engineering

Will the Carbon Border Adjustment Mechanism Impact European Electricity Prices? A GNN-Based Network Analysis

تستخدم هذه الورقة إطار عمل للشبكات العصبية الرسومية المكانية والزمانية لتوضيح أن آلية تعديل حدود الكربون التابعة للاتحاد الأوروبي ستعيد تشكيل ترتيب الاستحقاق في سوق الكهرباء بشكل جذري، مما يخلق مزايا سعرية هيكلية للدول ذات الكربون المنخفض مثل فرنسا وسويسرا، بينما تفرض عبئاً مزدوجاً من التكاليف المتزايدة على الدول ذات الكربون المرتفع مثل بولندا.

Jiachen Shen, Jian Shi, Dan Wang, Han Zhu2026-05-06
💻 computer science

Beyond Distributive Justice: Hermeneutical Fairness in Ad Delivery

تقترح هذه الورقة إطار عمل مبتكرًا لتوصيل الإعلانات عبر الإنترنت يدمج مفهوم ميراندا فريكر عن الظلم التأويلي مع العدالة التوزيعية التقليدية لمنع الحجب المنهجي أو تشويه الموارد التفسيرية للفئات المحمية، مُثبتةً من خلال عمليات المحاكاة أن موازنة هذه المخاوف المعرفية مع المنفعة الاقتصادية يمكن أن تخفف من الضرر دون خسارة اقتصادية كبيرة.

Camilla Quaresmini, Valentina Breschi, Jessica Leoni, Viola Schiaffonati, Mara Tanelli, Giulia De Pasquale2026-05-06
💻 computer science

Brainrot: Deskilling and Addiction are Overlooked AI Risks

تجادل هذه الورقة بأن جهود سلامة الذكاء الاصطناعي ومواءمته الحالية تغفل المخاطر الحرجة المتعلقة بتراجع المهارات المعرفية والإدمان الناجم عن الاعتماد المفرط على الذكاء الاصطناعي التوليدي، وتقترح أن العمل المستقبلي يجب أن يعالج هذه المخاوف المعرفية والصحة النفسية من خلال البحث والتنظيم وحملات التوعية العامة.

Ilias Chalkidis, Anders Søgaard2026-05-06