cs.CY
2257 ورقة بحثية
Evaluating Prediction-based Interventions with Human Decision Makers In Mind
تُصوّغ هذه الورقة نماذج متنوعة لاتخاذ القرار البشري عند الاستعانة بالأنظمة التنبؤية لتوضيح كيف تؤدي الانحيازات المعرفية والارتباطات بين الذوات إلى انتهاك الافتراضات التجريبية القياسية، مما يقوض دقة تقديرات الأثر السببي في تقييمات أنظمة القرار المؤتمتة.
LLM Agents for Education: Advances and Applications
تقدم هذه الورقة مسحاً منهجياً لوكلاء النماذج اللغوية الكبيرة (LLMs) في مجال التعليم، حيث تحلل أسسها التكنولوجية وتطبيقاتها في مهام مثل توليد التغذية الراجعة وتصميم المناهج الدراسية، مع معالجة التحديات الحرجة مثل الأخلاقيات، والهلوسة، والتكامل مع الأنظمة البيئية.
Mutually Assured Deregulation
تجادل الورقة بأن الاستراتيجية السائدة المتمثلة في التضحية بلوائح سلامة الذكاء الاصطناعي من أجل اكتساب ميزة تنافسية هي خلل قاتل يخلق حالة من "الإنهاء المتبادل للضوابط التنظيمية"، وتؤكد أن الأمن الحقيقي يتطلب أطرًا تنظيمية أقوى لا أضعف لمنع كارثة عالمية مشتركة.
Building Interpretable Models for Moral Decision-Making
تقدم هذه الورقة نموذج "ترانسفورمر" (transformer) مدمجاً مكوناً من طبقتين، يحقق دقة بنسبة 77% على بيانات "المورال ماشين" (Moral Machine)، مع استخدام تقنيات التفسير للكشف عن كيفية توزيع الاستدلال الأخلاقي والتحيزات عبر مراحل حوسبية متميزة في الشبكات العصبية.
Perceptions of AI-CBT: Trust and Barriers in Chinese Postgrads
تكشف هذه الدراسة النوعية أنه بينما ينظر طلاب الدراسات العليا الصينيون بشكل إيجابي إلى روبوتات الدردشة القائمة على العلاج المعرفي السلوكي المدعومة بالذكاء الاصطناعي لسهولة الوصول إليها وتوافرها على مدار الساعة طوال أيام الأسبوع، إلا أن اعتمادهم لها يعوقه بشكل كبير المخاوف المتعلقة بخصوصية البيانات، والسلامة العاطفية، ومدى ملاءمة الذكاء الاصطناعي للقضايا النفسية المعقدة، مما يسلط الضل على الحاجة إلى تصميم حساس ثقافياً وضمانات شفافة.
Predicting Depressive Symptoms through Emotion Pairs within Asian American Families
تستخدم هذه الدراسة نموذجاً قائماً على تقنية BERT لتحليل السرديات عبر الإنترنت للأطفال الأمريكيين من أصل آسيوي، كاشفةً أنه في حين تتنبأ أزواج المشاعر السلبية والإيجابية على التوالي بأعراض الاكتئاب وتخفف منها، فإن التزامن بين المشاعر المتضاربة يقدم رؤى معقدة حول ديناميكيات الصحة النفسية عبر الأجيال.
The CitizenQuery Benchmark: A Novel Dataset and Evaluation Pipeline for Measuring LLM Performance in Citizen Query Tasks
تقدم هذه الورقة CitizenQuery-UK، وهي مجموعة بيانات مرجعية جديدة تتكون من 22,000 استعلام اصطناعي تم إنشاؤها بناءً على معلومات حكومية بريطانية، وتقيم 11 نموذجاً لغوياً كبيراً من حيث الواقعية، والامتناع عن الإجابة، والإسهاب لتسليط الضوء على تحديات الموثوقية الحرجة والحاجة إلى الإقرار بقابلية الذكاء الاصطناًعي للخطأ في تطبيقات القطاع العام.
Convivial Fabrication: Towards Relational Computational Tools For and From Craft Practices
تجادل هذه الورقة بأن أدوات التصنيع الحاسوبي الحالية غالباً ما تخذل مجتمعات الحرف عبر معاملة المواد كعناصر سلبية، وتقترح إطاراً من "العلاقات الودية" عبر المستويات الفردية والمجتمعية والمؤسسية لتوجيه تصميم الأدوات التي تعزز الحوار النشط مع المادة، والمعرفة الجماعية، والاستقلالية.
Growth First, Care Second? Tracing the Landscape of LLM Value Preferences in Everyday Dilemmas
تحلل هذه الورقة هياكل مقايضة القيم في سياقات طلب النصيحة اليومية باستخدام مجموعة بيانات منسقة من أربعة مجتمعات فرعية على موقع "ريديت"، وتجد أن النماذج اللغوية الكبيرة تعطي الأولوية باستمرار لـ "الاستكشاف والنمو" على حساب "الإحسان والتواصل"، مما يثير مخاوف بشأن احتمالية تجانس القيم في عملية اتخاذ القرار التي تتم بوساطة الذكاء الاصطناعي.