🤖 AI

How Do Language Models Process Ethical Instructions? Deliberation, Consistency, and Other-Recognition Across Four Models

تكشف هذه الدراسة، من خلال محاكاة متعددة الوكلاء عبر أربعة نماذج لغوية، أن معالجة التعليمات الأخلاقية تتباين باختلاف القدرة والنمط الخاص بكل نموذج، حيث حددت أربعة أنواع متميزة للمعالجة الأخلاقية وأثبتت أن الامتثال اللفظي لتعليمات السلامة لا يعكس بالضرورة مداولة أخلاقية داخلية حقيقية.

Hiroki Fukui2026-04-02
🤖 AI

WHBench: Evaluating Frontier LLMs with Expert-in-the-Loop Validation on Women's Health Topics

تقدم الورقة البحثية WHBench، وهو معيار مرجعي متخصص يتكون من 47 سيناريو صاغها خبراء عبر 10 موضوعات في صحة المرأة، والذي يقيم 22 نموذجاً لغوياً كبيراً من النماذج الرائدة ويكشف أن حتى أفضل النماذج أداءً تفشل في تجاوز دقة قدرها 72.1%، مما يسلط الض الضوء على فجوات كبيرة في السلامة السريرية والعدالة والالتزام بالإرشادات التوجيهية التي تستوجتن إشرافاً من الخبراء قبل النشر.

Sneha Maurya, Pragya Saboo, Girish Kumar2026-04-02
⚡ electrical engineering

Agentic AI and Occupational Displacement: A Multi-Regional Task Exposure Analysis of Emerging Labor Market Disruption

تقدم هذه الورقة إطار عمل "التعرض للمهام الوكيلة" (ATE) لتوضيح أن وكلاء الذكاء الاصطناعي المستقلين، الذين ينفذون سير عمل كاملاً بدلاً من مهام منفصلة، يشكلون خطر إزاحة أعلى بكثير على المهن كثيفة المعلومات عبر المناطق الرئيسية في الولايات المتحدة بحلول عام 2030، مع تجاوز 93.2% من الأدوار التي تم تحليلها عتبات المخاطر المتوسطة، بينما يخلقون في الوقت ذاته فرصاً جديدة في مجالات حوكمة الذكاء الاصطناعي والتعاون بين الإنسان والذكاء الاصطناعي.

Ravish Gupta, Saket Kumar2026-04-02
💻 computer science

Price of Anarchy of Algorithmic Monoculture

تعمم هذه الورقة نموذجاً للاحتكار الخوارزمي في أسواق المطابقة لتثبت أن خسارة الرفاه الاجتماعي الناتجة عن ذلك محدودة بعامل ثابت ضيق قدره 2، مما يشير إلى أن الأمثلة اللامركزية تظل قريبة من المثالية رغم انتشار المشورة الخوارزمية المشتركة.

Robert Kleinberg, Erald Sinanaj, Éva Tardos2026-04-02
💻 computer science

Misconception Acquisition Dynamics in Large Language Models

تقدم هذه الورقة MalAlgoLib وتثبت أنه بينما يمكن للنماذج اللغوية الكبيرة تعلم مفاهيم خاطئة متعددة دون تدهور في الاستنتاج عند تدريبها باستخدام خطوات وسيطة، إلا أنها تفشل في اكتساب المفاهيم الخاطئة أو تفرط في تعميمها بدون مثل هذه الإشرافات الخطوة بخطوة، مما يسلط الضوء على الدور الحاسم لآثار الاستدلال الوسيطة في تحقيق التوازن بين محاكاة الطالب الوفية والحفاظ على الاستدلال الصحيح.

Naiming Liu, Xinghe Chen, Richard Baraniuk, Mrinmaya Sachan, Shashank Sonkar2026-04-02
📊 statistics

Car Dependency in Urban Accessibility

تقدم هذه الدراسة مؤشرًا مبتكرًا للتبعية للسيارات لقياس فجوات إمكانية الوصول عبر 18 مدينة، كاشفةً أن التوسعات المنهجية في شبكات النقل ضرورية لتفكيك الأنظمة القائمة على السيارات وتحقيق تنقل حضري مستدام وعادل.

Bruno Campanelli, Francesco Marzolla, Matteo Bruno, Hygor Piaget Monteiro Melo, Vittorio Loreto2026-04-02
🤖 AI

Aligning Recommendations with User Popularity Preferences

تتناول هذه الورقة البحثية انحياز الشعبية في أنظمة التوصية من خلال تقديم إطار عمل "معايرة مئينات الشعبية" لقياس عدم التوافق بين المستخدم والموصي، واقتراح منهجية SPREE، وهي طريقة لتوجيه التنشيط أثناء الاستدلال تعمل على مواءمة التوصيات تكيفياً مع تفضيلات الشعبية لكل مستخدم على حدة مع الحفاظ على الجودة العامة للتوصيات.

Mona Schirmer, Anton Thielmann, Pola Schwöbel, Thomas Martynec, Giuseppe Di Benedetto, Ben London, Yannik Stein2026-04-02
💻 computer science

The Hands-Up Problem and How to Deal With It: Secondary School Teachers' Experiences of Debugging in the Classroom

تتقصى هذه الدراسة تجارب معلمي المدارس الثانوية في تدريس عملية تصحيح الأخطاء البرمجية (debugging) في البرمجة القائمة على النصوص، حيث تحدد "مشكلة رفع اليد" الشائعة التي يعتمد فيها الطلاب بشكل كبير على دعم المعلم، وتسلط الض الضوء على الحاجة إلى تطوير مهني مستهدف لمساعدة المعلمين الأقل ثقة في تعزيز استقلالية الطلاب.

Laurie Gale, Sue Sentance2026-04-01
🤖 AI

Evaluating Online Moderation Via LLM-Powered Counterfactual Simulations

تقدم هذه الورقة محاكياً مدعوماً بنماذج اللغات الكبيرة يتيح التقييم المضاد للواقع لاستراتيجيات الإشراف عبر الإنترنت، مما يثبت فعاليتها في كبح الخطاب السام ويكشف رؤى حول العدوى الاجتماعية والتدخل الشخصي.

Giacomo Fidone, Lucia Passaro, Riccardo Guidotti2026-04-01
🤖 AI

Mitigating "Epistemic Debt" in Generative AI-Scaffolded Novice Programming using Metacognitive Scripts

تُظهر هذه الدراسة أنه بينما يعزز المساعدة غير المقيدة من الذكاء الاصطناعي الإنتاجية البرمجية الفورية للمبتدئين، إلا أنها تخلق "ديناً معرفياً" يؤدي إلى معدل فشل بنسبة 77% في مهام الصيانة بدون ذكاء اصطناعي، في حين أن نهجاً مدعوماً باستخدام بروتوكول "التعلم بالاسترجاع" يحافظ بشكل كبير على الكفاءة التصحيحية من خلال فرض المشاركة الميتامعرفية.

Sreecharan Sankaranarayanan2026-04-01