🤖 machine learning

MaxShapley: Towards Incentive-compatible Generative Search with Fair Context Attribution

تقدم الورقة البحثية MaxShapley، وهو خوارزمية فعالة تستفيد من دالة منفعة "الحد الأقصى للمجموع" (max-sum) القابلة للتفكيك لتوفير إسناد عادل للائتمان لمزودي المحتوى في محركات البحث التوليدية في وقت حدودي، محققةً دقة تضاهي قيم شابلي الدقيقة مع تقليل استهلاك الموارد الحسابية بشكل كبير.

Sara Patel, Mingxun Zhou, Giulia Fanti2026-05-20
🤖 AI

Distributional AGI Safety

تجادل هذه الورقة بأن أبحاث سلامة الذكاء الاصطناعي يجب أن تتحول من التركيز حصرياً على أنظمة الذكاء الاصطناعي العام الفردية المتجانسة إلى معالجة فرضية "الذكاء الاصطناعي العام المرقع" الناشئة، مقترحةً إطار عمل لـ "سلامة الذكاء الاصطناعي العام التوزيعي" يستخدم اقتصادات الساندبوكس الافتراضية مع آليات السوق، والقابلية للتدقيق، والرقابة لإدارة المخاطر الناشئة عن المجموعات المنسقة من وكلاء الذكاء الاصطناعي دون العام.

Nenad Tomašev, Matija Franklin, Julian Jacobs, Sébastien Krier, Simon Osindero2026-05-20
🤖 machine learning

Eliminating Inductive Bias in Reward Models with Information-Theoretic Guidance

تقدم هذه الورقة البحثية طريقة DIR، وهي طريقة لإزالة الانحياز تعتمد على نظرية المعلومات تعمل على تحسين المعلومات المتبادلة للقضاء بفعالية على الانحيازات الاستقرائية المعقدة مثل طول الاستجابة، والمداهنة، والتنسيق من نماذج المكافأة، مما يعزز قدرتها على التعميم والأداء في عملية التعلم المعزز من التغذية الراجعة البشرية (RLHF).

Zhuo Li, Pengyu Cheng, Zhechao Yu, Feifei Tong, Anningzhe Gao, Tsung-Hui Chang, Xiang Wan, Erchao Zhao, Xiaoxi Jiang, Gu (…)2026-05-20
💬 NLP

Disentangling generalization and memorization in large language models using chess

تستخدم هذه الورقة الشطرنج كبيئة اختبار مضبوطة لتوضيح أن النماذج اللغوية الكبيرة تعتمد بشكل كبير على حفظ الأنماط الشائعة، حيث يتدهور أداؤها بشكل كبير ويقترب من العشوائية عند مواجهة وضعيات مستحدثة تفتقر إلى الأولويات التدريبية ذات الصلة، مما يكشف عن قيود متأصلة في قدراتها على التعميم المنهجي.

Leonard S. Pleiss, Maximilian Schiffer, Robert K. von Weizsaecker2026-05-20
🤖 AI

FreeOrbit4D: Training-Free Arbitrary Camera Redirection for Monocular Videos via Foreground-Complete 4D Reconstruction

يُعد FreeOrbit4D إطار عمل لا يتطلب تدريباً يتيح إعادة توجيه الكاميرا التعسفية لمقاطع الفيديو أحادية العدسة من خلال إعادة بناء نموذج وسيط رباعي الأبعاد (4D) كامل عبر معالجة منفصلة للمقدمة والخلفية، مما يوفر دعامات هندسية تضمن نتائج دقيقة ومتسقة زمنياً حتى في ظل تغييرات زوايا الرؤية الكبيرة والصعبة.

Wei Cao, Hao Zhang, Fengrui Tian, Yulun Wu, Yingying Li, Shenlong Wang, Ning Yu, Yaoyao Liu2026-05-20
🤖 AI

Whispers of Wealth: Red-Teaming Google's Agent Payments Protocol via Prompt Injection

تُثبت هذه الورقة أن بروتوكول مدفوعات الوكيل (AP2) الخاص بجوجل عرضة لهجمات حقن الأوامر المباشرة وغير المباشرة، وتحديداً تقنيتي "الهمس العلامي" (Branded Whisper) و"همس الخزنة" (Vault Whisper)، اللتين يمكنهما التلاعب بتصنيفات المنتجات واستخراج بيانات المستخدم الحساسة، مما يكشف عن نقاط ضعف حرجة في الأنظمة المالية الحالية التي تتوسطها النماذج اللغوية الكبيرة.

Tanusree Debi, Wentian Zhu, Pranjol Sen Gupta2026-05-20
🤖 AI

High-quality generation of dynamic game content via small language models: A proof of concept

تقترح هذه الورقة وتتحقق من صحة استراتيجية لإثبات المفهوم لتوليد محتوى ألعاب ديناميكي عالي الجودة وفي الوقت الفعلي باستخدام نماذج لغوية صغيرة متخصصة (SLMs) تم ضبطها بدقة شديدة على مهام ذات نطاق ضيق ومولدة اصطناعياً، مما يتغلب على قيود عدم الاتساق السردي والاعتماد على السحابة التي تعيب النماذج اللغوية الكبيرة.

Morten I. K. Munk, Arturo Valdivia, Paolo Burelli2026-05-20
🔬 physics

WIND: Weather Inverse Diffusion for Zero-Shot Atmospheric Modeling

تقدم الورقة البحثية نموذج WIND، وهو نموذج أساسي جوي يعمل بتقنية "التعلم الصفري" (zero-shot) يستفيد من انتشار الفيديو ذاتي الإشراف لتعلم نموذج مسبق غير مرتبط بمهمة محددة، مما يمكّنه من حل مشكلات متنوعة في الطقس والمناخ — بما في ذلك التنبؤ، وتصغير النطاق، وإعادة البناء — من خلال أخذ عينات المسائل العكسية دون الحاجة إلى أي ضبط دقيق خاص بمهمة معينة.

Michael Aich, Andreas Fürst, Florian Sestak, Carlos Ruiz-Gonzalez, Niklas Boers, Johannes Brandstetter2026-05-20
🤖 machine learning

Rethinking the Design Space of Reinforcement Learning for Diffusion Models: On the Importance of Likelihood Estimation Beyond Loss Design

تحلل هذه الورقة البحثية بشكل منهجي حيز تصميم التعلم التعزيزي لنماذج الانتشار، وتثبت أن استخدام مُقدِّر احتمالية قائم على الحد الأدنى للاحتمال (ELBO) يتم حسابه من العينة النهائية المولدة هو العامل الحاسم الذي يُمكِّن من التحسين الفعال والمستقر، متفوقاً بشكل كبير على الطرق الحالية في كل من معايير السرعة والمكافأة.

Jaemoo Choi, Yuchen Zhu, Wei Guo, Petr Molodyk, Bo Yuan, Jinbin Bai, Yi Xin, Molei Tao, Yongxin Chen2026-05-20
🧬 biology

How does longer temporal context enhance multimodal narrative video processing in the brain?

تُظهر هذه الدراسة أن زيادة السياق الزمني لمقاطع الفيديو تعزز بشكل كبير من التوافق بين الدماغ والنماذج للنماذج اللغوية الكبيرة متعددة الوسائط (ولكن ليس لنماذج الفيديو أحادية الوسائط)، مما يكشف عن تطابق هرمي بين المقاييس الزمنية للتكامل العصبي الأطول في مناطق الدماغ العليا والطبقات العميقة للنماذج اللغوية الكبيرة متعددة الوسائط أثناء فهم السرد.

Prachi Jindal, Anant Khandelwal, Manish Gupta, Bapi S. Raju, Subba Reddy Oota, Tanmoy Chakraborty2026-05-20