💬 NLP

VideoNorms: Benchmarking Cultural Awareness of Video Language Models

تقدم هذه الورقة البحثية VideoNorms، وهي مجموعة بيانات تضم أكثر من 3,0٠٠ تعليق توضيحي للمعايير الثقافية مستمدة من برامج تلفزيونية أمريكية وصينية تم إنشاؤها من خلال التعاون بين البشر والذكاء الاصطناعي، والتي تكشف أن نماذج الفيديو اللغوية الكبيرة (VideoLLMs) الحالية تعاني بشكل أكبر مع السياقات الثقافية الصينية والأدلة غير اللفظية، مما يسلط الضوء على الحاجة إلى تدريب وتقييم قائمين على أسس ثقافية.

Nikhil Reddy Varimalla, Yunfei Xu, Meng Fan Wang, Arkadiy Saakyan, Smaranda Muresan2026-07-30
💻 computer science

The New Shape of Search: How Conversational AI Recomposes Information Seeking

تحلل هذه الورقة سلوك المستخدم عبر واجهات البحث والذكاء الاصطناعي التوليدي لتكشف أن رحلات المعلومات يتم "إعادة تكوينها" بحيث تتبع المساعدات الذكية في كثير من الأحيان عمليات البحث والتصفح التقليدية بدلاً من المبادرة بها، وتكون أكثر اكتفاءً ذاتياً من جلسات البحث، دون أن يعني ذلك بالضرورة إنجاز المهمة.

Michael Iannelli, Alan Ai2026-07-30
💻 computer science

Archetypes or ability? Clustering for modelling student mathematical competence

من خلال تطبيق أساليب التجميع على مجموعة بيانات ضخمة من نتائج امتحانات الطلاب في المملكة المتحدة، تتحدى هذه الدراسة الافتراض القائل بأن الكفاءة الرياضية تتكون من مجموعات مهارية منفصلة ومتسلسلة، حيث وجدت بدلاً من ذلك أن القدرة العامة هي العامل المهيمن، مع إثبات أن النماذج القابلة للتفسير يمكنها تحقيق أداء تنافسي للتعلم الشخصي.

Benjamin Mawdsley, Tom Quilter, Richard Turner, Sarah Jackson, Paul Edwards2026-07-30
💻 computer science

The Age of AI Agents Demands A New Scientific Paradigm To Sustain Trustworthy Science

تجادل هذه الورقة بأن صعود وكلاء أبحاث الذكاء الاصطناعي المستقلين يستلزم نموذجاً جديداً للتحقق العلمي يركز على تدفقات العمل القابلة للملاحظة، والتدقيقات القابلة للتوسع، والإسناد الواضح، وذلك لمنع حدوث فراغات في المساءلة والحفاظ على الثقة في العلم.

Belinda Mo2026-07-30
💰 quantitative finance

The Human Utility Factor: A Computable Welfare Metric That Reframes AI Governance as a Constrained Optimisation Problem

تقدم هذه الورقة "عامل المنفعة البشرية" (HUF)، وهو مقياس رفاهية قابل للتفاضل يعيد صياغة حوكمة الذكاء الاصطناًعي كمسألة تحسين مقيدة من خلال قياس المقايضات بين الأتمتة، وإعادة التوزيع، والتوظيف لتحديد العتبات السياساتية التي تمنع عدم الاستقرار الاجتماعي والاقتصادي رغم الامتثال التنظيمي.

Sivasathivel Kandasamy2026-07-30
💻 computer science

AI Security Priorities: A Field-Wide Agenda

تقدم هذه الورقة أجندة متعددة القطاعات وذات أولوية للنهوض بأمن الذكاء الاصطناعي، منظمة في أربعة محاور رئيسية ومستمدة من مقابلات وورش عمل مع خبراء، لتوجيه الاستثمار والعمل المنسق في حماية أنظمة الذكاء الاصطناعي وبنيتها التحتية مع تجاوز وتيرة اعتمادها لسرعة الجاهزية الأمنية.

Gil Gekker, Rachel Steratore, Everett Smith, Asher Brass-Gershovich, Varun Gandhi, Nicole Nichols, Vijay Bolina, Buck Sh (…)2026-07-30
🤖 AI

When benchmark inferences do not compose: Projectibility in AI evaluation

تجادل هذه الورقة بأن الاستنتاجات الصحيحة لمعايير الذكاء الاصطناعي لا تترجم تلقائياً إلى ادعاءات تبعية مبررة بسبب عدم التوافق في النهايات والافتراضات والارتباطات، وتقترح إطار عمل "تدقيق القابلية للإسقاط" لتشخيص هذه الروابط المنطقية غير المدعومة.

Brett Reynolds2026-07-30
💬 NLP

A large-scale corpus of religious radio broadcast transcripts from webstream recordings in the United States

تقدم هذه الورقة مجموعة بيانات ضخمة تضم أكثر من 700,000 مقطع من البرامج الإذاعية الدينية باللغة الإنجليزية، تم تفريغها وتصنيف المتحدثين فيها، من شهر يوليو 2025، جُمعت من 785 بثاً عبر الويب تمثل أكثر من 2,000 محطة في الولايات المتحدة، وذلك لتسهيل البحث في محتوى الوسائط الدينية، والخطاب الاجتماعي السياسي، ومعالجة الكلام.

Samuel Bestvater, Athena Chapekis, Skyler Seets, Anna Lieb, Sono Shah, Aaron Smith2026-07-30
💬 NLP

Aligning LLM-Simulated and Human Examinees for Psychometric Calibration: A Cognitive Diagnostic Profiling Approach

تقدم هذه الورقة "التوصيف التشخيصي المعرفي" (CDP)، وهو إطار عمل يعتمد على التعلم الصفري، يقوم بتوجيه النماذج اللغوية الكبيرة لمحاكاة ملفات تعريف معرفية متنوعة للممتحنين، مما يحسن بشكل كبير من توافقها مع المختبرين البشريين عبر توزيعات القدرة، وأنماط الإتقان، وصعوبات الفقرات لتمكين المعايرة السيكومترية العملية وفعالة التكلفة.

Wenjie Zhou, Yunting Liu, Renjiao Tang, Mark Wilson2026-07-30
💻 computer science

"Nobody Did This": Contribution, Originality, and Accountability in Agent-Mediated Collaboration

تقدم هذه الورقة مفهوم "تلاشي المساهمة" للحجاج بأن دمج وكلاء النماذج اللغوية الكبيرة في سير العمل التعاوني يقوض الظروف الاجتماعية اللازمة لنسب الأعمال والمساءلة، مما يستلزم تحولاً من مجرد حلول التوثيق إلى أجندة بحثية واستجابة بنوية أوسع.

Kashif Imteyaz, Mohammad Rashidujjaman Rifat, Divya Ramesh, Steven R. Rick, Simo Hosio, Hauke Sandhaus, Advait Sarkar, C (…)2026-07-30