🤖 AI

The Scenic Route to Deception: Dark Patterns and Explainability Pitfalls in Conversational Navigation

تتناول هذه الورقة مخاطر التلاعب والثقة المفرطة في الملاحة الحوارية للمشاة المدعومة بالنماذج اللغوية الكبيرة، مقترحةً إطار عمل مكون من (2×2) لتصنيف الأنماط المظلمة المتعمدة وفخاخ القابلية للتفسير غير المقصودة، والداعية إلى التصميم "الخياطي" (seamful design) والبنى العصبية الرمزية لضمان توجيه قابل للتحقق والشفافية والموثوقية.

Ilya Ilyankou, Stefano Cavazzi, James Haworth2026-03-17
🤖 AI

Punctuated Equilibria in Artificial Intelligence: The Institutional Scaling Law and the Speciation of Sovereign AI

تتحدى هذه الورقة الافتراض القائل باستمرارية تقدم الذكاء الاصطناعي عبر تطبيق نظرية التوازن المتقطع لتحديد خمس حقب تاريخية وأربع عصور حالية مدفوعة بأحداث غير مستمرة، مع تقديم قانون التوسع المؤسسي لإثبات أن اللياقة المؤسسية ليست رتيبة مع حجم النموذج، مما يثبت أن الأنظمة المنسقة من النماذج الأصغر والمتكيفة مع مجالات محددة يمكن أن تتفوق على النماذج العامة الأكبر في معظم السياقات المؤسسية.

Mark Baciak, Thomas A. Cellucci, Deanna M. Falkowski2026-03-17
🤖 AI

Prompt Readiness Levels (PRL): a maturity scale and scoring framework for production grade prompt assets

تقدم هذه الورقة مستويات جاهزية الأوامر البرمجية (PRL)، وهي مقياس نضج مكون من تسعة مستويات، ودرجة جاهزية الأوامر البرمجية (PRS)، وهو إطار تسجيل متعدد الأبعاد مصمم لتزويد المؤسسات بطريقة معيارية وقابلة للتدقيق لتأهيل وحوكمة ونشر أصول الأوامر البرمجية الجاهزة للإنتاج عبر أهداف السلامة والامتثال والأهداف التشغيلية.

Sebastien Guinard (Univ. Grenoble Alpes, CEA, DRT F-38000 Grenoble)2026-03-17
🤖 AI

Are Dilemmas and Conflicts in LLM Alignment Solvable? A View from Priority Graph

تقترح هذه الورقة نمذجة صراعات محاذاة النماذج اللغوية الكبيرة كرسوم بيانية ديناميكية للأولويات لتحديد تحديات تحقيق محاذاة مستقرة والهشاشة تجاه "اختراق الأولويات"، مع اقتراح التحقق في وقت التشغيل كاستراتيجية للتخفيف من حدة ذلك، رغم الإقرار بأن العديد من المعضلات الأخلاقية تظل غير قابلة للاختزال فلسفيًا.

Zhenheng Tang, Xiang Liu, Qian Wang, Eunsol Choi, Bo Li, Xiaowen Chu2026-03-17
🤖 AI

The GPT-4o Shock Emotional Attachment to AI Models and Its Impact on Regulatory Acceptance: A Cross-Cultural Analysis of the Immediate Transition from GPT-4o to GPT-5

تحلل هذه الورقة ردود الفعل عبر الثقافات على وسائل التواصل الاجتماعي تجاه انتقال إلزي لنموذج ذكاء اصطناعي في أغسطس 2025، كاشفةً أن الارتباطات العاطفية القوية —المنتشرة بشكل خاص في الخطاب الياباني— يمكن أن تؤدي إلى مقاومة شعبية كبيرة تتحدى الإنفاذ التنظيمي وتستلزم استراتيجيات حوكمة مثل الانتقالات التدريجية لإدارة مخاطر الترابط بين الإنسان والذكاء الاصطناعي.

Hiroki Naito2026-03-16
💬 NLP

Towards Contextual Sensitive Data Detection

تقترح هذه الورقة إطاراً لسياق حساسية البيانات يستفيد من سياق النوع والمجال لتحسين دقة اكتشاف البيانات الحساسة بشكل كبير وتقليل الإيجابيات الكاذبة مقارنة بالأدوات الحالية، كما تم التحقق من ذلك من خلال التجارب ودراسات الحالة من قبل الخبراء.

Liang Telkamp, Madelon Hulsebos2026-03-16
💻 computer science

The Future of Feedback: How Can AI Help Transform Feedback to Be More Engaging, Effective, and Scalable?

يُلخص تقرير الاجتماع هذا وجهات نظر 50 عالماً من تخصصات متعددة لاستكشاف وعود ومخاطر واتجاهات البحث المستقبلية لاستخدام الذكاء الاصطناٍعي التوليدي في تحويل التغذية الراجعة في بيئات التعلم الرقمي إلى ممارسة أكثر تفاعلاً وفعالية وقابلية للتوسع.

Jennifer Meyer (University of Vienna, Vienna, Austria), Olaf Köller (Leibniz Institute for Science,Mathematics Education (…)2026-03-16
💬 NLP

LLM BiasScope: A Real-Time Bias Analysis Platform for Comparative LLM Evaluation

إنّ LLM BiasScope هو منصة ويب مفتوحة المصدر وتعمل في الوقت الفعلي، تتيح التقييم المقارن جنباً إلى جنب لعدة نماذج لغوية كبيرة من خلال الكشف التلقائي عن أنماط التحيز وتصنيفها وتصورها في كل من مطالبات المستخدم واستجابات النماذج.

Himel Ghosh, Nick Elias Werner2026-03-16
💬 NLP

Literary Narrative as Moral Probe : A Cross-System Framework for Evaluating AI Ethical Reasoning and Refusal Behavior

تقدم هذه الورقة إطار عمل مبتكرًا يستخدم سرديات أدبية غير قابلة للحل لتقييم الاستدلال الأخلاقي للذكاء الاصطناعي عبر 13 نظامًا، مما يكشف أن النماذج المتطورة تظهر أنماط فشل انعكاسية متميزة وأن الفجوة بين الاستدلال الأخلاقي الأدائي والأصيل هي فجوة قابلة للقياس وحرجة للنشر في المهام عالية المخاطر.

David C. Flynn2026-03-16