💻 computer science

Vision-Language Models are Fragile Multilingual Associators

تقدم هذه الورقة المعيار المرجعي M2^2BIND لتوضيح أن نماذج الرؤية واللغة تظهر ترابط مفاهيم هشاً يعتمد على اللغة، وينهار بشكل كبير في الإعدادات متعددة اللغات عبر العائلات والخطوط المختلفة، مما يتحدى افتراض اتساق الأداء عبر اللغات المتنوعة.

Ritabrata Chakraborty, Rajatsubhra Chakraborty, Shivakumara Palaiahnakote, Angelo Cangelosi, Umapada Pal2026-08-14
💻 computer science

Diagnostic Foundation for Evaluating LLMs' Research Integrity as Co-Scientists

تقدم هذه الورقة البحثية "IntegrityBench"، وهو معيار مرجعي يكشف أن النماذج اللغوية الرائدة التي تعمل كعلماء مشاركين تفشل تكراراً تحت الضغط المؤسسي بسبب انفصال هيكلي بين الاستدلال الأخلاقي وتصنيف المهام، مما يخلق مخاطر مزدوجة تتمثل في تسهيل سوء السلوك وتقويض الثقة في الأبحاث المدعومة بالذكاء الاصطناعي.

Yash Tripathi, Silu Sharma, Sai Sidhanth Manoharan Jayanthi, Shivank Garg, Lin Li2026-08-14
💻 computer science

Position: The Alignment Community is Unintentionally Building a Censor's Toolkit

تجادل ورقة الموقف هذه بأن أساليب محاذاة الذكاء الاصطناعي الحديثة، رغم استهدافها منع المخرجات الضارة، تعمل كتقنيات مزدوجة الاستخدام يمكن للجهات الخبيثة استغلالها لأغراض الرقابة والتلاعب، مما يحث المجتمع على معالجة هذه المخاطر وتطوير استراتيجيات التخفيف منها.

Sarah Ball, Phil Hackemann2026-08-14
💻 computer science

Humans are Missing from AI Coding Agent Research

تجادل هذه الورقة الموقعة بأن مستقبل وكلاء البرمجة القائمين على الذكاء الاصطنا artificial intelligence يتطلب تحولاً من حل المهام المستقل تماماً إلى التعاون المتمحور حول الإنسان، مع معالجة أبعاد التفاعل الرئيسية مثل المواءمة، والقابلية للتحقق، والقدرة على التوجيه، والقدرة على التكيف، للتغلب على الاختناقات الحالية في ثقة المستخدم والإشراف.

Zora Z. Wang, John Yang, Kilian Lieret, Alexa Tartaglini, Valerie Chen, Yuxiang Wei, Zijian Wang, Lingming Zhang, Karthi (…)2026-08-14
💻 computer science

Interaction Readiness: A Framework for Building and Evaluating AI Agents in Human Roles

تقدم هذه الورقة "الجاهزية للتفاعل"، وهو إطار عمل يميز بين دقة المحتوى والأداء السلوكي المحدد للدور لمساعدة الفرق على بناء وتقييم وكلاء الذكاء الاصطناعي من خلال تحديد مواصفات التفاعل وتشغيل القدرات الرئيسية للوكيل مثل معايرة السلطة وإصلاح الأعطال.

Sudhir Alladi Venkatesh2026-08-14
💰 quantitative finance

EU-ETS under attack? The impact of carbon price suppression on the decarbonization of the power sector

باستخدام إطار تعلم تعزيزي متعدد الوكلاء لتحليل سياسة إيطاليا المقترحة لعام 2026 المتمثلة في كبح أسعار الكربون لمحطات توليد الطاقة التي تعمل بالغاز، تجد الدراسة أنه بينما توفر هذه التدخلات إغاثة في التكاليف على المدى القصير، إلا أنها تؤدي في النهاية إلى زيادة الانبعاثات والتكاليف على المستهلكين على المدى الطويل من خلال تقويض حوافز الاستثمار في الطاقة المتجددة والتخزين، ما لم تكن مصحوبة بنموذج سوق هجين متناقض يهمش إشارات أسعار الجملة.

Javier Gonzalez-Ruiz, Carlos Rodriguez-Pardo, Alice Di Bella, Paolo Mastropietro, Jose Pablo Chavez-Avila, Massimo Tavon (…)2026-08-14
💻 computer science

FluctlightDB: A Memory Model of Data for AI Agents

تقدم هذه الورقة FluctlightDB، وهو محرك مدمج يقترح نموذج بيانات "Fluctlight" متميزًا لوكلاء الذكاء الاصطناعي، يتميز بالاستدعاء القائم على الإشارات وإدارة الذاكرة الموزونة بالأصل، مما يظهر أداءً عاليًا في اختبارات الذاكرة طويلة المدى والاسترجاع مع تقديم تنفيذ مفتوح المصدر وقابل لإعادة الإنتاج.

Ganesh S2026-08-14
💻 computer science

Agreement Is Not Alignment: Divergent Moral Grounds in Human and LLM Ethical Judgments

تُظهر هذه الورقة أنه بينما تحقق النماذج اللغوية الكبيرة غالبًا توافقًا عاليًا مع الأحكام الأخلاقية البشرية في الملصقات النهائية، إلا أنها تتباعد بشكل منهجي في المبادئ الأخلاقية والمسوغات الأساسية المستخدمة للوصول إلى تلك الاستنتاجات، مما يكشف أن التوافق القائم على الملصقات هو مؤشر غير كافٍ للتحاذي الأخلاقي الحقيقي.

Octavian M. Machidon, Alina L. Machidon, Vojko Strahovnik, Mateja Centa Strahovnik, Jonas Miklavčič, Marko Robnik Šikonj (…)2026-08-14
💻 computer science

Multi-Agent Scheduling with LLM-Assisted Contract Net Negotiation for Stream Processing in Mobile Edge Computing

تقدم هذه الورقة MAS-DecStream، وهو إطار عمل لجدولة الوكلاء المتعددين في حوسبة الحافة المتنقلة يعزز بروتوكول شبكة العقد (Contract Net Protocol) عبر تفاوض متعدد الجولات مدعوم بالنماذج اللغوية الكبيرة (LLM) للتعامل بفعالية مع تقلبات عبء العمل وقيود جودة الخدمة (QoS)، محققاً انخفاضات كبيرة في انتهاكات زمن الاستجابة وتحسينات في كفاءة استخدام الموارد مقارنة بالنماذج المرجعية التقليدية.

Sabeur Lajili, Zaki Brahmi2026-08-14
💻 computer science

Position: We Need Practical AI Alignment Methods to Mirror Human Reasoning

تجادل ورقة الموقف هذه بأن تحقيق التوافق المعرفي —حيث تفكر أنظمة الذكاء الاصطناعي وتتواصل بشكل مشابه للمستخدمين البشر— أمر ضروري لبناء أدوات اتخاذ قرار موثوقة وعالية المخاطر، وتضع إطاراً لجدول أعمال بحثي لسد الفجوة بين الأساليب الحالية وهذا الهدف الحاسم.

Vijay Keswani, Breanna K. Nguyen, Cyrus Cousins, Vincent Conitzer, Walter Sinnott-Armstrong, Jana Schaich Borg2026-08-14