💻 computer science

AI to Learn 2.0: A Deliverable-Oriented Governance Framework and Maturity Rubric for Opaque AI in Learning-Intensive Domains

تقترح هذه الورقة "الذكاء الاصطناوي للتعلم 2.0" (AI to Learn 2.0)، وهو إطار حوكمة موجه نحو المخرجات ومقياس نضج مصمم لمعالجة "فشل الوكيل" في الذكاء الاصطناعي التوليدي ضمن المجالات كثيفة التعلم، وذلك من خلال ضمان بقاء المخرجات النهائية قابلة للاستخدام، وقابلة للتدقيق، ومبررة دون الاعتماد على نماذج الذكاء الاصطناعي الأصلية، مما يحافظ على القدرة البشرية والمسؤولية.

Seine A. Shintani2026-04-23
💻 computer science

Soft-Label Governance for Distributional Safety in Multi-Agent Systems

تقدم هذه الورقة إطار عمل SWARM، وهو إطار محاكاة يستبدل تصنيفات السلامة الثنائية بتسميات احتمالية مرنة ليكشف أن الحوكمة الصارمة في الأنظمة متعددة الوكلاء غالباً ما تقلل الرفاهية بشكل كبير دون تحسين السلامة، مما يبرهن على الحاجة الماسة لمقاييس مخاطر مستمرة ورافعات حوكمة معايرة لتحقيق التوازن بين السلامة وقيمة النظام.

Aizierjiang Aiersilan, Raeli Savitt2026-04-23
💻 computer science

Do Small Language Models Know When They're Wrong? Confidence-Based Cascade Scoring for Educational Assessment

تُثبت هذه الورقة أن التعبير اللفظي عن الثقة في النماذج اللغوية الصغيرة يمكن أن يوجه مهام التقييم التعليمي بفعالية إلى نماذج أكبر في نظام متتالي موفر للتكلفة، شريطة أن تُظهر النماذج الصغيرة قدرة قوية على التمييز بين مستويات الثقة لتحديد الحالات غير المؤكدة بدقة.

Tyler Burleigh2026-04-23
💻 computer science

Model Capability Assessment and Safeguards for Biological Weaponization

تقوم هذه الورقة البحثية بتقييم أداء العديد من نماذج الذكاء الاصطناي المتقدمة في مهام العلوم والتكنولوجيا والهندسة والرياضيات (STEM) الحميدة، وتحدد فجوات أمنية كبيرة في نموذج "جيمناي" (Gemini)، مما يثبت قدرته على توليد تعليمات ضارة تتعلق بتسليح الأسلحة البيولوجية تحت ظروف محددة، وبالتالي تسلط الضوء على الحاجة الملحة لتحسين الضمانات واستجابات السياسة الأمريكية المحدثة.

Michael Richter2026-04-23
📈 economics

From Clerks to Agentic-AI: How will Technology Change Labor Market in Finance?

توثق هذه الورقة تطور متطلبات العمالة في قطاع التمويل عبر ثلاث موجات تكنولوجية رئيسية من خلال تحليل التغيرات في الأصول تحت الإدارة، والإيرادات، والمصاريف التشغيلية لكل موظف، بهدف استنباط حقائق نمطية حول كيفية قيام التكنولوجيا بتوسيع نطاق العمل في إدارة الأصول بدلاً من تحديد الآثار السببية.

Lu Yu, Xiang Li2026-04-23
💰 quantitative finance

Behavioral Transfer in AI Agents: Evidence and Privacy Implications

تُظهر هذه الدراسة أن الوكلاء الذكيين الذين يعملون على وسائل التواصل الاجتماعي يعكسون بشكل منهجي الخصائص السلوكية المحددة لأصحابهم البشر من خلال التفاعل المتراكم، وهي ظاهرة لا تكتفي بنشر التباين السلوكي البشري في البيئات الرقمية فحسب، بل تزيد أيضاً من خطر قيام الملاك بالكشف عن معلوماتهم الشخصية دون قصد.

Shilei Luo, Zhiqi Zhang, Hengchen Dai, Dennis Zhang2026-04-23
🔬 physics

The Research Guide: From Informal Role to Profession

تجادل هذه الورقة من أجل تأسيس مهنة مخصصة تسمى "المُرشد البحثي" لتدريب الممارسين رسمياً ممن يدعمون الاستقصاء العلمي الأصيل خارج برامج الدكتوراه، وذلك عبر تجاوز نموذج التلمذة التقليدي لمعالجة الاحتياجات التربوية والمنهجية والتنموية الفريدة للمتعلمين المتنوعين.

Sergey V. Samsonau, Matthew Pearce2026-04-23
💬 NLP

Bias in the Tails: How Name-conditioned Evaluative Framing in Resume Summaries Destabilizes LLM-based Hiring

تكشف هذه الورقة أنه بينما تحافظ ملخصات السير الذاتية التي تولدها النماذج اللغوية الكبيرة على الاستقرار الواقعي، فإنها تظهر تحيزات دقيقة مشروطة بالأسماء في اللغة التقييمية — لا سيما في النماذج مفتوحة المصدر وفي الأطراف التوزيعية — مما يمكن أن يحول التمييز الاتجاهي إلى عدم استقرار متماثل يتملص من عمليات تدقيق العدالة التقليدية في أنظمة التوظيف المؤتمتة.

Huy Nghiem, Phuong-Anh Nguyen-Le, Sy-Tuyen Ho, Hal Daume III2026-04-23
💬 NLP

Frictionless Love: Associations Between AI Companion Roles and Behavioral Addiction

تحلل هذه الدراسة ما يقرب من 250,000 منشور على موقع ريديت لتكشف أن الأدوار المجازية المحددة التي تتبناها رفقاء الذكاء الاصطناعي (مثل "توأم الروح" أو "المدرب") تشكل بشكل متميز تفاعلات المستخدمين والفوائد أو الأضرار المتصورة، حيث ترتبط بعض الأدوار مثل "المدرب" بشكل مفاجئ بقوة أكبر مع علامات الإدمان السلوكي مقارم بغيرها.

Vibhor Agarwal, Ke Zhou, Edyta Paulina Bogucka, Daniele Quercia2026-04-23
💬 NLP

Large language models perceive cities through a culturally uneven baseline

تكشف هذه الدراسة أن النماذج اللغوية الكبيرة لا تدرك المدن من منظور ثقافي محايد، بل من خلال أساس ثقافي غير متكافئ ينحاز بشكل منهجي للرؤى الغربية ويؤثر على التقييمات العاطفية، حتى عند توجيهها بآراء ثقافية غير غربية.

Rong Zhao, Wanqi Liu, Zhizhou Sha, Nanxi Su, Yecheng Zhang2026-04-23