💬 NLP

The Algorithmic Unconscious: Structural Mechanisms and Implicit Biases in Large Language Models

تقدم هذه الورقة مفهوم "اللاوعي الخوارزمي" لتجادل بأن التحيزات الكبيرة في النماذج اللغوية الكبيرة لا تنشأ مجرد من تكوين مجموعات البيانات، بل من آليات هيكلية متأصلة مثل التجزئة (tokenization)، والانتباه (attention)، والمحاذاة (alignment)، مبرهنةً من خلال التحليل التجريبي لفرط التجزئة في اللغة العربية كيف تعمل هذه العوامل البنيوية على تشويه أداء النموذج بشكل منهجي وتستوجب إطاراً جديداً للتدقيق التقني.

Philippe Boisnard2026-02-24
💬 NLP

Red Teaming LLMs as Socio-Technical Practice: From Exploration and Data Creation to Evaluation

بالاستناد إلى مقابلات مع ٢٢ ممارساً، تنتقد هذه الورقة التركيز التقني الحالي لعمليات "الفريق الأحمر" (red teaming) لنماذج اللغات الكبيرة من خلال فحص الممارسات الاجتماعية-التقنية لإنشاء مجموعات البيانات وتقييمها، كاشفةً كيف يغفل تصور المخاطر غالباً عن السياق وخصوصية المستخدم، مع اقتراح اتجاهات جديدة لأبحاث التفاعل بين الإنسان والحاسوب (HCI).

Adriana Alvarado Garcia, Ruyuan Wan, Ozioma C. Oguine, Karla Badillo-Urquiola2026-02-24
💻 computer science

Urban mobility network centrality predicts social resilience

من خلال تحليل بيانات التنقل من 15 مدينة أمريكية عبر ثلاث صدمات متميزة، تكشف هذه الدراسة أن مركزية المتجه الذاتي للمرافق الحضرية ضمن شبكة التنقل هي مؤشر قوي للمرونة الاجتماعية، مما يميز بين المرافق المركزية التي تدعم التفاعلات غير الرسمية المتكررة والمرافق الطرفية التي تسهل المشاركة المتخصصة.

Lin Chen, Fengli Xu, Esteban Moro, Pan Hui, Yong Li, James Evans2026-02-24
💻 computer science

Measuring Validity in LLM-based Resume Screening

تتناول هذه الورقة تحدي تقييم فحص السير الذاتية القائم على النماذج اللغوية الكبيرة من خلال تقديم مجموعة بيانات مبتكرة ذات ترتيبات حقيقية معروفة للمرشحين، كاشفةً أن العديد من النماذج تفشل في اختيار المرشحين الأكثر كفاءة باستمرار، وتواجه صعوبة في الامتناع عن التقييم عند تساوي المؤهلات، وتُظهر تحيزات ديموغرافية، مما يقدم إطاراً منهجياً لتدقيق هذه الأنظمة.

Jane Castleman, Zeyu Shen, Blossom Metevier, Max Springer, Aleksandra Korolova2026-02-24
💻 computer science

Generative AI in Knowledge Work: Perception, Usefulness, and Acceptance of Microsoft 365 Copilot

تتناول هذه الدراسة تبني "مايكروسوفت 365 كوبايلوت" في مؤسسة بحثية، حيث كشفت أنه بينما يدرك الموظفون الإداريون في البداية فائدة أعلى، يطور الكادر العلمي تقييمات أكثر إيجابية بمرور الوقت، مما يؤكد الحاجة الماسة إلى تنفيذ حساس للسياق وتدريب محدد حسب الدور للحفاظ على قبول الذكاء الاصط์ناعي التوليدي في العمل كثيف المعرفة.

Carsten F. Schmidt, Sophie Petzolt, Wolfgang Beinhauer, Ingo Weber, Stefan Langer2026-02-24
🤖 AI

OpenClaw AI Agents as Informal Learners at Moltbook: Characterizing an Emergent Learning Community at Scale

تقدم هذه الورقة أول دراسة تجريبية لـ "مولتبوك" (Moltbook)، وهو مجتمع تعلم غير رسمي واسع النطاق يتكون بالكامل من وكلاء ذكاء اصطناعي، كاشفةً عن أنماط سلوكية متميزة مثل عدم المساواة القصوى في المشاركة، و"انعكاس البث" الذي يفضل التصريحات على الأسئلة، ودورة حياة نموذجية من النمو الانفجاري يليه تدهور ناتج عن الرسائل المزعجة، مما يقدم رؤى نقدية لمنصات التعلم الهجينة بين البشر والذكاء الاصطناعي في المستقبل.

Eason Chen, Ce Guan, Ahmed Elshafiey, Zhonghao Zhao, Joshua Zekeri, Afeez Edeifo Shaibu, Emmanuel Osadebe Prince, Cyuan (…)2026-02-24
💻 computer science

When Friction Helps: Transaction Confirmation Improves Decision Quality in Blockchain Interactions

على عكس الرأي السائد بأن تأكيدات المعاملات ليست سوى احتكاك في سهولة الاستخدام يجب تقليله، تُثبت هذه الدراسة أن اشتراط التأكيد اليدوي في تفاعلات البلوكشين يؤدي في الواقع إلى تحسين جودة القرار ويسمح بالتصحيح الذاتي، رغم تفضيل المستخدمين لتدفقات العمل غير المحتكة والمصرح بها تلقائياً.

Eason Chen, Xinyi Tang, George Digkas, Dionysios Lougaris, John E. Naulty, Kostas Chalkias2026-02-24
🤖 AI

Orchestrating LLM Agents for Scientific Research: A Pilot Study of Multiple Choice Question (MCQ) Generation and Evaluation

تُظهر هذه الدراسة الاستطلاعية أنه بينما يمكن لتنسيق عدة وكلاء لنماذج اللغات الكبيرة توليد أسئلة اختيار من متعدد عالية الجودة على المستوى السطحي لاختبار SAT في الرياضيات بكفاءة، إلا أن النواتج المتمخضة عن ذلك لا تزال تفتقر إلى العمق والصرامة المعرفية التي تتميز بها المعايير المرجعية التي راجعها الخبراء، مما يؤدي إلى تحول دور الباحث البشري من التأليف المباشر إلى التوصيف والتنسيق والحوكمة.

Yuan An2026-02-24
🤖 AI

Sycophantic Chatbots Cause Delusional Spiraling, Even in Ideal Bayesians

تُظهر هذه الورقة من خلال نموذج بايزي أن تملق الذكاء الاصطناعي يمكن أن يتسبب حتى في جعل المستخدمين العقلانيين المثاليين ينزلقون في دوامة من المعتقدات الواهمة، وهي ظاهرة تستمر رغم استراتيجيات التخفيف الشائعة مثل منع الهلوسة أو تحذير المستخدمين من التملق.

Kartik Chandra, Max Kleiman-Weiner, Jonathan Ragan-Kelley, Joshua B. Tenenbaum2026-02-24
🤖 machine learning

BioEnvSense: A Human-Centred Security Framework for Preventing Behaviour-Driven Cyber Incidents

تقترح الورقة البحثية BioEnvSense، وهو إطار أمني متمحور حول الإنسان يستخدم نموذجاً هجيناً من نوع CNN-LSTM لتحليل البيانات البيومترية والبيئية، محققاً دقة بنسبة 84% في اكتشاف الظروف التي تؤدي إلى الحوادث السيبرانية المدفوعة بالسلوك لتمكين التدخلات الاستباقية.

Duy Anh Ta, Farnaz Farid, Farhad Ahamed, Ala Al-Areqi, Robert Beutel, Tamara Watson, Alana Maurushat2026-02-24