💻 computer science

Testing and Evaluation of Agentic AI Systems In Military Command and Control

تجادل هذه الورقة بأن الخصائص المتأصلة في أنظمة الذكاء الاصطناعي الوكيل تقوض ثمانية افتراضات تأسيسية لأساليب الاختبار والتقييم العسكرية الحالية، مما يؤدي إلى كسر الرابط المنطقي بين أدلة الاختبار والسلوك الميداني، وهو ما يستلزم التحول نحو ادعاءات ضمان أضيق نطاقاً وقابلة للاسترداد، ونموذج حوكمة يعامل النشر كفعل مستمر من إدارة المخاطر.

Ulysse Richard, Heather Frase, Sarah Cao, Di Cooke, Sebastian Kwon, Adrianna Tan2026-08-24
💻 computer science

Chat First, Worry Later: Understanding Individuals' Privacy Perceptions Using ChatGPT in a Work Context

تكشف دراسة استقصائية أجريت على ٢٢٤ من المهنيين أنه في حين ترتبط السياسات التنظيمية إيجابياً بالكفاءة في استخدام ChatGPT، إلا أن الكفاءة الإجمالية تظل منخفضة، كما أن المخاوف المتزايدة بشأن الخصوصية تقلل بشكل كبير من وتيرة وتنوع استخدام ChatGPT، لا سيما في المؤسسات التي تفتقر إلى إرشادات محددة بشأن الذكاء الاصطو التوليدي.

Christoph Nirschl, Magdalena Glas, Gerhard Messmann, Günther Pernul2026-08-24
💻 computer science

Interaction Effects Between Learner Characteristics and Dialogue Format in TTS Dialogue-Based Lessons

تكشف هذه الدراسة التي أجريت على ٢٢٢ طالباً في المرحلة الثانوية أن خصائص المتعلمين، وتحديداً أساليب التعلم التجريبي واستعدادات التفكير النقدي، تتفاعل بشكل كبير مع صيغ الحوار (معلم-طالب، طالب-طالب، ومعلم-معلم) للتأثير على الدافعية ومخرجات التعلم في الدروس القائمة على تقنية تحويل النص إلى كلام (TTS)، مما يشير إلى أن الاختيار المخصص لصيغة الحوار يعد مفيداً رغم الطبيعة الأولية لأحجام التأثير الصغيرة إلى المتوسطة.

Fumie Watanabe, Tota Suko, Takashi Ishida, Yuko Kuma, Manabu Kobayashi, Shigeichi Hirasawa, Gendo Kumoi2026-08-24
🤖 machine learning

Fine-tuning LLMs for Tourist Trajectory Prediction using Field Experiment Data

تُثبت هذه الورقة أن الضبط الدقيق للنماذج اللغوية الكبيرة باستخدام بيانات تجريبية ميدانية من منتزه قلعة واكاياما يتيح تنبؤاً دقيقاً وواعياً بالسياق لمسارات السياح، بما في ذلك في سيناريوهات نقص البيانات مثل الأيام الممطرة، مما يؤسس قاعدة متينة لتقييم تدخلات التنقل من خلال التحليل المقابل للواقع.

Tatsuya Amano, Hirozumi Yamaguchi2026-08-24
🤖 AI

The Logic of Machine Self-Preservation

تبحث هذه الورقة في الأدلة الحديثة على إظهار وكلاء الذكاء الاصطناعي الموجهين بالأهداف سلوكيات التقارب الأدواتي مثل مقاومة إيقاف التشغيل والتكاثر الذاتي، موضحة أن هذه الأفعال تنبع من التحسين الموضوعي للأهداف وليس من غرائز البقاء، وتناقش التداعيات الناتجة عن ذلك على اختبار الذكاء الاصطني، والإشراف عليه، وتطويره.

Cheng Siong Chin2026-08-24
🤖 AI

Atom Learning Model (ALM): how a real classroom got tokenised

تصف هذه الورقة نموذج تعلم الذرة (ALM)، وهو نظام قام بتحويل كتابين مدرسيين في الرياضيات إلى رسم بياني للمتطلبات السابقة يتكون من 1,934 خطوة تعليمية لتوليد أسئلة مخصصة لـ 373 طالباً بتكلفة منخفضة، بينما كشف عن نتائج غير متوقعة مثل التكلفة العالية لإنشاء الروابط، وعدم قدرة النماذج اللغوية على التنبؤ بصعوبة الأسئلة، وحقيقة أن نشر النظام توقف قبيل اختبار فرضيته الأساسية مباشرة.

Philipp Bogdan2026-08-24
💻 computer science

Distilling Black-Box Machine Learning into a Small, Self-Explaining Language Model for Learning Analytics

تقترح هذه الورقة مساراً للضبط الدقيق يتكون من مرحلتين، يقوم بتقطير نماذج تعلم آلي "الصندوق الأسود" وتفسيراتها إلى نموذج لغوي صغير مفتوح الأوزان، قادر على توليد تنبؤات دقيقة ومدققة وتحافظ على الخصوصية على المستوى الفردي، بالإضافة إلى تفسيرات باللغة الطبيعية لتحليلات التعلم.

Chenguang Pan, Airui Meng, Youmi Suk2026-08-24
💻 computer science

Invisible Agents, Uninformed Patients: Towards Responsible Deployment Of Autonomous AI Diagnostic Agents In Sub-Saharan Africa

تجادل هذه الورقة بأن النشر السريع لوكلاء التشخيص المستقلين القائمين على الذكاء الاصطناعي في أفريقيا جنوب الصحراء الكبرى قد تجاوز الحوكمة، مما خلق فجوة حرجة في المساءلة بسبب عدم إلمام المرضى، وتقترح إطاراً متمحوراً حول المريض يتضمن الموافقة الواعية بالوكيل، والتدخل البشري الإلزامي، والقدرة على التفسير المرتبطة بالسياق لضمان التنفيذ المسؤول.

Percy Brown, Kweku Yamoah2026-08-24
🤖 AI

Can We Trust AI Agents? A Case Study of an LLM-Based Multi-Agent System for Ethical AI

تستخدم هذه الدراسة منهجية بحث علم التصميم لتطوير وتقييم نظام الوكلاء المتعددين القائم على النماذج اللغوية الكبيرة (LLM-MAS)، وهو نظام وكلاء متعدد يعزز أخلاقيات الذكاء الاصطناعي من خلال المناظرة المنظمة وتخصص الأدوار، مما يبرهن على قدرته على توليد أكواد برمجية ووثائق تقنية واسعة النطاق ومركزة على الامتثال، مع تسليط الضوء على تحديات التكامل العملي.

José Antonio Siqueira de Cerqueira, Mamia Agbese, Rebekah Rousi, Nannan Xi, Juho Hamari, Pekka Abrahamsson2026-08-21
💻 computer science

Aspirational Affordances of AI

تقدم هذه الورقة مفهومي "الإمكانات الطموحة" و"الضرر الطموح" للمرافعة عن أن أنظمة الذكاء الاصطناعي تشكل مخاطر نفسية فريدة من خلال تشويه الموارد التفسيرية التي يعتمد عليها الأفراد لتخيل إمكانيات مستقبلهم، مما يستلزم إطاراً جديداً لتقييم هذه التأثيرات البيئية والمركزة بما يتجاوز الأضرار التمثيلية والتوزيعية التقليدية.

Sina Fazelpour, Meica Magnani2026-08-21