💻 computer science

Simulating Couple Conflict: Designing A Multi-Agent System for Therapy Training and Practice

تقدم هذه الورقة نظام محاكاة متعدد الوكلاء ينمذج العلاج الزوجي كنظام ديناميكي متحكم فيه وذي حالة لتدريب المعالجين على إدارة أنماط صراع "المطالبة والانسحاب"، مما أظهر واقعية واستجابة فائقتين مقارنة بالنماذج المرجعية القائمة على التلقين في دراسة شملت ٢١ متخصصاً مرخصاً.

Canwen Wang, Angela Chen, Catherine Bao, Siwei Jin, Holly Swartz, Tongshuang Wu, Robert E Kraut, Haiyi Zhu2026-04-07
🤖 machine learning

Teaching Machine Learning Fundamentals with LEGO Robotics

تقدم هذه الورقة "تعلم الآلة بالمكعبات"، وهي منصة مفتوحة المصدر قائمة على الويب ودورة تدريبية لمدة يومين تستخدم أنشطة روبوتات ليغو خالية من البرمجة لتدريس خوارزميات تعلم الآلة الأساسية بفعالية للطلاب الذين تتراوح أعمارهم بين 12 و17 عاماً، مما أدى إلى تحسينات ذات دلالة إحصائية في فهمهم التقني وتحفيزهم وتفاعلهم.

Viacheslav Sydora, Guner Dilsad Er, Michael Muehlebach2026-04-07
🤖 machine learning

Making Bias Non-Predictive: Training Robust LLM Reasoning via Reinforcement Learning

تقدم هذه الورقة تدريب الاستقلال المعرفي (EIT)، وهو إطار عمل للتعلم التعزيزي يعزز متانة النماذج اللغوية الكبيرة ضد التحيزات المعرفية من خلال جعل إشارات التحيز غير تنبؤية بالمكافآت، مما يؤدي إلى استقلال معرفي قابل للنقل يحسن الدقة ويتعمم عبر أنواع التحيز، والمعايير المرجعية، ومقاييس النماذج غير المرئية دون الحاجة إلى تسميات البيئة.

Qian Wang, Xuandong Zhao, Zirui Zhang, Zhanzhi Lou, Nuo Chen, Dawn Song, Bingsheng He2026-04-07
💻 computer science

Privacy by Voice: Modeling Youth Privacy-Protective Behavior in Smart Voice Assistants

تكشف هذه الدراسة التي أجريت على 469 من الشباب الكندي أن الكفاءة الذاتية في الخصوصية هي المحرك الأساسي لسلوكيات حماية الخصوصية في المساعدات الصوتية الذكية، حيث تعمل كوسيط حاسم يجب تعزيزه للتغلب على عوائق المخاطر والفوائد المتصورة والثقة.

Molly Campbell, Ajay Kumar Shrestha2026-04-07
💻 computer science

Evaluating AI-Generated Images of Cultural Artifacts with Community-Informed Rubrics

تقترح هذه الورقة إطاراً لدمج منظورات المجتمع في تقييم الذكاء الاصطنا-عي عبر إشراك الفئات المهمشة في مرحلة "التمثيل المنهجي" لتحديد تمثيلات ملائمة ثقافياً للمصنوعات، والتي يتم بعد ذلك تحويلها إلى أدوات قياس آلية باستخدام النماذج اللغوية الكبيرة متعددة الوسائط.

Nari Johnson, Deepthi Sudharsan, Hamna, Samantha Dalal, Theo Holroyd, Anja Thieme, Hoda Heidari, Daniela Massiceti, Jen (…)2026-04-07
💻 computer science

AI Fact-Checking in the Wild: A Field Evaluation of LLM-Written Community Notes on X

تقدم هذه الورقة أول تقييم ميداني لنظام للتحقق من الحقائق قائم على النماذج اللغوية الكبيرة (LLM) تم نشره في ميزة "ملاحظات المجتمع" (Community Notes) على منصة إكس، حيث أثبتت من خلال دراسة استمرت ثلاثة أشهر أن الملاحظات المكتوبة بواسطة الذكاء الاصط artificially تحقق درجات أعلى في درجة الفائدة وإجماعاً أوسع عابراً للحزبية مقارنة بالملاحظات المكتوبة بشرياً عند ضبط ديناميكيات المنصة.

Haiwen Li, Michiel A. Bakker2026-04-07
💻 computer science

Beyond the AI Tutor: Social Learning with LLM Agents

تقدم هذه الورقة تجربتين مضبوطتين تُثبتان أن تكوينات النماذج اللغوية الكبيرة متعددة الوكلاء، التي تحاكي التعلم الاجتماعي من خلال تفاعلات متنوعة بين الأقران والمعلمين، تعزز نتائج التعلم وتنوع الأفكار بشكل كبير مقارنة بالتدريس التقليدي من طرف واحد عبر الذكاء الاصطناعي.

Harsh Kumar (Jace), Zi Kang (Jace), Mu, Jonathan Vincentius, Ashton Anderson2026-04-07
💻 computer science

Evaluating Bounded Superintelligent Authority in Multi-Level Governance: A Framework for Governance Under Radical Capability Asymmetry

تتحدى هذه الورقة الافتراض التأسيسي للتماثل المعرفي في الحوكمة عبر بناء إطار سداسي الأبعاد يكشف كيف يؤدي التباين الجذري في القدرات بين سلطة فائقة الذكاء ومحدودة النطاق وبين المحكومين إلى إخفاقات هيكلية في الشرعية، والمساءلة، والقابلية للتصحيح، وعدم الهيمنة، مما يثبت في نهاية المطاف أن التصميم المؤسسي الحالي غير كافٍ لمعالجة الأزمات المعيارية الفريدة المتمثلة في عدم القابلية للفهم والهيمنة الدائمة.

Tony Rost2026-04-07
💻 computer science

Prosocial Persuasion at Scale? Large Language Models Outperform Humans in Donation Appeals Across Levels of Personalization

تُظهر تجربتان مسجلتان مسبقاً أن النماذج اللغوية الكبيرة تتفوق على البشر في صياغة نداءات التبرع المقنعة، مما يحقق مستويات أعلى من التفاعل والتبرعات عبر مختلف مستويات التخصيص.

John Caffier, Olga Stavrova, Bennett Kleinberg2026-04-07
🤖 AI

Position: Science of AI Evaluation Requires Item-level Benchmark Data

تجادل هذه الورقة الموقفية بأن تأسيس علم صارم لتقييم الذكاء الاصطناعي يتطلب اعتماد بيانات معيارية على مستوى العناصر للتغلب على إخفاقات الصلاحية المنهجية، وتدعم هذا الادعاء من خلال تحليل عابر للتخصصات وتقديم OpenEval، وهو مستودع جديد للتقييم القائم على الأدلة.

Han Jiang, Susu Zhang, Xiaoyuan Yi, Xing Xie, Ziang Xiao2026-04-07