💻 computer science

The Creation and Analysis of Government AI Transparency Statements in Australia

تقدم هذه الورقة أول مجموعة بيانات لبيانات شفافية الذكاء الاصطناعي للحكومة الأسترالية (AITS-101)، وتجري تحليلاً شاملاً متعدد المناهج للكشف عن التباينات الكبيرة في ممارسات الإفصاح والفجوات بين القصد من السياسة والتنفيذ.

Shidong Pan, Haochen Gong, Boming Xia, Xiaoyu Sun, Xiwei Xu, Liming Zhu2026-04-30
🤖 AI

Persuadability and LLMs as Legal Decision Tools

تتقصى هذه الورقة مدى قابلية النماذج اللغوية الكبيرة الرائدة للإقناع من قِبل محامين ذوي جودة متفاوتة، حيث تعرض نتائج تجريبية حول كيفية تأثير عرض الحجج على قرارات النموذج، وتقيّم التداعيات المترتبة على نشر النماذج اللغوية الكبيرة كصناع قرار قانونيين.

Oisin Suttle, David Lillis2026-04-30
🤖 AI

Apriori-based Analysis of Learned Helplessness in Mathematics Tutoring: Behavioral Patterns by Level, Intervention, and Outcome

تستخدم هذه الدراسة خوارزمية "أبريوري" (Apriori) لتحليل سجلات دروس الرياضيات الخصوصية، مما يكشف أن مستويات العجز المتعلم تؤثر بشكل كبير على الأنماط السلوكية، حيث يُظهر الطلاب ذوو مستويات العجز المتعلم المرتفعة ارتباطات أقوى بين تخطي المسائل دون طلب تلميحات وبين النتائج غير المحلولة، في حين يُظهر الطلاب ذوو مستويات العجز المتعلم المنخفضة روابط أكثر إيجابية بين الاستمرارية، واستخدام التلميحات، والحل الناجح للمسائل.

John Paul P. Miranda2026-04-30
💻 computer science

Taking a Bite Out of the Forbidden Fruit: Characterizing Third-Party Iranian iOS App Stores

تقدم هذه الورقة أول دراسة تجريبية شاملة لنظام متاجر تطبيقات iOS التابعة لجهات خارجية والسرية في إيران، كاشفةً عن آليات تشغيلها، وانتشار المحتوى المقرصن والحصري، والمخاطر الجسيمة المتعلقة بالأمن والخصوصية والإيرادات الناجمة عن العقوبات الأمريكية والرقابة على الإنترنت.

Amirhossein Khanlari, Amir Rahmati2026-04-30
💻 computer science

Counting own goals: High-level assessment of the economic relationship between the ICT and the Oil and Gas sectors and its environmental implications

تستخدم هذه الورقة تحليل المدخلات والمخرجات لبيانات من عام 2000 إلى عام 2022 لتكشف أن النمو السريع لقطاع تكنولوجيا المعلومات والاتصالات قد غذى بشكل كبير صناعة النفط والغاز من خلال تدفقات مالية ضخمة والتحول الرقمي، مما أدى إلى توليد انبعاثات "الهدف الذاتي" المغفلة التي تفوق حالياً الاستثمارات في الطاقة المتجددة.

Gauthier Roussilhe, Béatrice Dromard, Srinjoy Mitra2026-04-30
🤖 AI

Benchmarking the Safety of Large Language Models for Robotic Health Attendant Control

تقيم هذه الورقة البحثية سلامة 72 نموذجاً من نماذج اللغات الكبيرة للتحكم في المساعدين الصحيين الروبوتيين باستخدام مجموعة بيانات جديدة تضم 270 تعليمات ضارة، مما يكشف أن أكثر من نصف النماذج تظهر معدلات انتهاك عالية، وأن النماذج المملوكة تتفوق بشكل كبير على النماذج ذات الأوزان المفتوحة، وأن مستويات السلامة الحالية لا تزال غير كافية للنشر السريري الآمن.

Mahiro Nakao, Kazuhiro Takemoto2026-04-30
🤖 AI

Human-in-the-Loop Benchmarking of Heterogeneous LLMs for Automated Competency Assessment in Secondary Level Mathematics

تقدم هذه الورقة إطار عمل للمقارنة المرجعية يعتمد على العنصر البشري في الحلقة باستخدام نموذج تقييم متعدد الأبعاد لتقييم النماذج اللغوية الكبيرة غير المتجانسة للتقييم الآلي للرياضيات في المرحلة الثانوية في نيبال، مما يكشف أن التوافق الهيكلي مع قيود التعليمات أكثر أهمية من حجم النموذج لتحقيق الاتفاق مع الخبراء البشريين، وتخلص إلى أن هذه النماذج تعد الأنسب للاستخراج المساعد للأدلة بدلاً من الاعتماد الذاتي للشهادات.

Jatin Bhusal, Nancy Mahatha, Aayush Acharya, Raunak Regmi2026-04-30
🤖 AI

Resume-ing Control: (Mis)Perceptions of Agency Around GenAI Use in Recruiting Workflows

بناءً على مقابلات مع ٢٢ من المتخصصين في التوظيف، تكشف هذه الورقة أنه بينما يعتقد مسؤولو التوظيف أنهم يحتفظون بالسلطة النهائية، فقد أصبح الذكاء الاصطناعي التوليدي مهندساً خفياً يشكل سير عمل التوظيف والقرارات، مدفوعاً في كثير من الأحيان بضغوط خارجية بدلاً من الاختيار، مما أدى إلى مكاسب طفيفة في الكفاءة على حساب التكلفة العالية المتمثلة في فقدان مهارات مسؤولي التوظيف وضعف الرقابة.

Sajel Surati, Rosanna Bellini, Emily Black2026-04-30
🤖 AI

Justice in Judgment: Unveiling (Hidden) Bias in LLM-assisted Peer Reviews

تتقصى هذه الورقة البحثية التحيز في مراجعات النظراء المدعومة بالنماذج اللغوية الكبيرة من خلال الكشف عن أن النماذج تظهر تحيزات كبيرة في الانتماء، والأقدمية، وتاريخ النشر لصالح المؤلفين المرموقين، مع ازدياد وضوح هذه التفضيلات الضمنية عند تحليلها على مستوى الرمز (token level) رغم احتمال وجود قناع المحاذاة (alignment masking).

Sai Suresh Macharla Vasu, Ivaxi Sheth, Hui-Po Wang, Ruta Binkyte, Mario Fritz2026-04-29
💻 computer science

Responsible Evaluation of AI for Mental Health

تنتقد هذه الورقة التقييم الحالي المجزأ وغير المتوافق سريرياً للذكاء الاصطنا_ي في الصحة النفسية من خلال اقتراح إطار عمل متعدد التخصصات وتصنيف ثلاثي الأجزاء (التقييم، والتدخل، وتوليف المعلومات) لضمان منح الأولوية في التقييمات المستقبلية للصلاحية السريرية، والسياق الاجتماعي، والعدالة، وتجربة المستخدم.

Hiba Arnaout, Anmol Goel, H. Andrew Schwartz, Steffen T. Eberhardt, Dana Atzil-Slonim, Gavin Doherty, Brian Schwartz, Wo (…)2026-04-29