🤖 AI

High-quality generation of dynamic game content via small language models: A proof of concept

تقترح هذه الورقة وتتحقق من صحة استراتيجية لإثبات المفهوم لتوليد محتوى ألعاب ديناميكي عالي الجودة وفي الوقت الفعلي باستخدام نماذج لغوية صغيرة متخصصة (SLMs) تم ضبطها بدقة شديدة على مهام ذات نطاق ضيق ومولدة اصطناعياً، مما يتغلب على قيود عدم الاتساق السردي والاعتماد على السحابة التي تعيب النماذج اللغوية الكبيرة.

Morten I. K. Munk, Arturo Valdivia, Paolo Burelli2026-05-20
🔬 physics

WIND: Weather Inverse Diffusion for Zero-Shot Atmospheric Modeling

تقدم الورقة البحثية نموذج WIND، وهو نموذج أساسي جوي يعمل بتقنية "التعلم الصفري" (zero-shot) يستفيد من انتشار الفيديو ذاتي الإشراف لتعلم نموذج مسبق غير مرتبط بمهمة محددة، مما يمكّنه من حل مشكلات متنوعة في الطقس والمناخ — بما في ذلك التنبؤ، وتصغير النطاق، وإعادة البناء — من خلال أخذ عينات المسائل العكسية دون الحاجة إلى أي ضبط دقيق خاص بمهمة معينة.

Michael Aich, Andreas Fürst, Florian Sestak, Carlos Ruiz-Gonzalez, Niklas Boers, Johannes Brandstetter2026-05-20
🤖 machine learning

Rethinking the Design Space of Reinforcement Learning for Diffusion Models: On the Importance of Likelihood Estimation Beyond Loss Design

تحلل هذه الورقة البحثية بشكل منهجي حيز تصميم التعلم التعزيزي لنماذج الانتشار، وتثبت أن استخدام مُقدِّر احتمالية قائم على الحد الأدنى للاحتمال (ELBO) يتم حسابه من العينة النهائية المولدة هو العامل الحاسم الذي يُمكِّن من التحسين الفعال والمستقر، متفوقاً بشكل كبير على الطرق الحالية في كل من معايير السرعة والمكافأة.

Jaemoo Choi, Yuchen Zhu, Wei Guo, Petr Molodyk, Bo Yuan, Jinbin Bai, Yi Xin, Molei Tao, Yongxin Chen2026-05-20
🧬 biology

How does longer temporal context enhance multimodal narrative video processing in the brain?

تُظهر هذه الدراسة أن زيادة السياق الزمني لمقاطع الفيديو تعزز بشكل كبير من التوافق بين الدماغ والنماذج للنماذج اللغوية الكبيرة متعددة الوسائط (ولكن ليس لنماذج الفيديو أحادية الوسائط)، مما يكشف عن تطابق هرمي بين المقاييس الزمنية للتكامل العصبي الأطول في مناطق الدماغ العليا والطبقات العميقة للنماذج اللغوية الكبيرة متعددة الوسائط أثناء فهم السرد.

Prachi Jindal, Anant Khandelwal, Manish Gupta, Bapi S. Raju, Subba Reddy Oota, Tanmoy Chakraborty2026-05-20
💬 NLP

Language Model Memory and Memory Models for Language

تجادل هذه الورقة بأن تدريب التنبؤ بالرمز التالي المعياري ينتج تمثيلات فقيرة معلوماتياً وغير صالحة للذاكرة، وتقترح بنية مشفر-فك تشفير قابلة للتوازي يتم تدريبها باستخدام أهداف سببية واحتفاظ بالمعلومات مشتركة لتحقيق تكوين ذاكرة عالي الدقة وكفاءة حوسبية.

Benjamin L. Badger2026-05-20
🤖 AI

Designing escalation criteria for international AI incident response: criteria, triggers, and thresholds

تقترح هذه الورقة إطار عمل للتصعيد التشغيلي يتضمن ثماني معايير ومخطط تدفق للقرار لتوجيه متى ينبغي تصعيد حوادث الذكاء الاصطناًعي من التعامل الوطني إلى التعامل الدولي، مع تحديد ثلاثة أنماط تصميمية تؤدي حالياً إلى نقص منهجي في الكشف ضمن الأنظمة التنظيمية القائمة.

Francesca Gomez, Matthew Ball, Michael Harre, Lydia Preston, Josephine Schwab, Caio Machado2026-05-20
🤖 AI

Skim: Speculative Execution for Fast and Efficient Web Agents

يُعد Skim إطار عمل للتنفيذ التخميني يقلل بشكل كبير من تكلفة وزمن استجابة وكلاء الويب عبر الاستفادة من هياكل المواقع الإلكترونية القابلة للتنبؤ لتجاوز مكونات الاستدلال الثقيلة لمعظم الاستعلامات، مع استخدام مُتحقق خفيف الوزن لضمان الدقة وتصعيد حالات الفشل النادرة بسلاسة إلى الوكلاء الكاملين.

Mike Wong, Kevin Hsieh, Suman Nath, Ravi Netravali2026-05-20
🤖 AI

SLEIGHT-Bench: A Benchmark of Evasion Attacks Against Agent Monitors

تقدم الورقة البحثية SLEIGHT-Bench، وهو معيار لـ 40 هجوماً اصطناعياً على وكلاء البرمجة عبر 11 فئة، كاشفةً أن أدوات المراقبة الحالية القائمة على النماذج اللغوية الكبيرة تواجه صعوبة في اكتشاف استراتيجيات التهرب الدقيقة، حيث حققت معدل ضبط قدره 32% فقط، مما يسلط الضال على الحاجة إلى تحسين تقنيات المراقبة.

Elle Najt, Colin Toft, Tyler Tracy, Fabien Roger, Joe Benton2026-05-20
🤖 AI

PrivScope: Task-scoped Disclosure Control for Hybrid Agentic Systems

تُعد PrivScope نظاماً موثوقاً للتحكم في الحمولة على الجهاز للأنظمة الوكيلة الهجينة، حيث تفرض ضبطاً للإفصاح على نطاق المهمة من خلال تصفية السياق غير ذي الصلة وتجريد التفاصيل الحساسة إلى أقل أشكالها كشفاً، مما يؤدي إلى القضاء على تسرب الملفات الشخصية وتقليل مخاطر إعادة تحديد الهوية مع الحفاظ على معدلات نجاح عالية للمهام عبر مختلف نماذج اللغة السحابية.

Shafizur Rahman Seeam (Ian), Zhengxiong Li (Ian), Zhiyuan Yu (Ian), Yimin (Ian), Chen, Yidan Hu2026-05-20
💻 computer science

Interoceptive Divergence in Aesthetic Evaluation and Implications for Human-AI Alignment

تكشف هذه الدراسة أنه بينما تستطيع النماذج اللغوية الكبيرة محاكاة أنماط التقييم الجمالي البشري فيما يتعلق بالعواطف وسمات الصور، إلا أنها تظهر تباينًا كبيرًا في الجوانب الاستبطانية مثل الأحاسيس الجسدية، مما يسلط الضوء على قيود حرجة في محاذاة الذكاء الاصطناعي الحالية وتمثيل بيانات التدريب.

Yoshia Abe, Tatsuya Daikoku, Yasuo Kuniyoshi2026-05-20