🤖 machine learning

Agent JIT Compilation for Latency-Optimizing Web Agent Planning and Scheduling

تقدم هذه الورقة "Agent JIT Compilation"، وهو إطار عمل يتكون من مخطط، ومجدول، وبروتوكول لفرض الثوابت، يقوم بتحويل المهام المكتوبة باللغة الطبيعية إلى كود قابل للتنفيذ لتحقيق تسريع كبير وتحسينات في الدقة مقارنة بحلقات الوكيل الويب المتسلسلة التقليدية.

Caleb Winston, Ron Yifeng Wang, Azalia Mirhoseini, Christos Kozyrakis2026-05-21
💻 computer science

WikiVQABench: A Knowledge-Grounded Visual Question Answering Benchmark from Wikipedia and Wikidata

تقدم الورقة البحثية WikiVQABench، وهو معيار تم تنسيقه بشرياً يجمع بين صور ويكيبيديا وتوضيحاتها وبيانات ويكيداتا لتقييم قدرات الاستدلال القائمة على المعرفة لنماذج الرؤية واللغة من خلال أسئلة متعددة الخيارات تتطلب معلومات خارجية تتجاوز الإدراك البصري.

Basel Shbita, Pengyuan Li, Anna Lisa Gentile2026-05-21
📊 statistics

Quantifying Hyperparameter Transfer and the Importance of Embedding Layer Learning Rate

تقدم هذه الورقة إطار عمل لقياس انتقال المعلمات الفائقة، وتكشف أن تفوق انتقال معدل التعلم الملحوظ في التحديث الأقصى (μ\muP) مقارنة بالمعلمة القياسية (SP) ينبع أساساً من القضاء على عنق زجاجة معدل تعلم طبقة التضمين، مما يعمل على استقرار التدريب وتحسين متانة الاستقراء.

Dayal Singh Kalra, Maissam Barkeshli2026-05-21
📊 statistics

Variance Reduction for Expectations with Diffusion Teachers

تقدم الورقة البحثية إطار عمل CARV، وهو إطار لتقليل التباين مدرك للحوسبة يستفيد من الحسابات المسبقة المستهلكة (amortized upstream computations)، وأخذ عينات الأهمية للخطوات الزمنية، وبناء دالة التوزيع التراكمي العكسي الطبقي (stratified-inverse-CDF) لخفض تباين مُقدّر مونت كارلو بشكل كبير وتحسين كفاءة الحوسبة في مسارات الانتشار (diffusion-based pipelines) مثل تحويل النص إلى ثلاثي الأبعاد (text-to-3D) وإسناد البيانات (data attribution).

Jesse Bettencourt, Xindi Wu, Matan Atzmon, James Lucas, Jonathan Lorraine2026-05-21
💬 NLP

Entry-level guide to the use of large language models for medical research

تقدم هذه الورقة دليلاً عملياً للمبتدئين من المتخصصين في الرعاية الصحية لدمج النماذج اللغوية الكبيرة المتطورة بفعالية وأمان في الأبحاث الطبية والممارسة السريرية من خلال سير عمل مهيكل يشمل صياغة المهام، واختيار النماذج، وهندسة الأوامر، والضبط الدقيق، والنشر المسؤول.

Qiao Jin, Nicholas Wan, Robert Leaman, Shubo Tian, Zhizheng Wang, Yifan Yang, Zifeng Wang, Guangzhi Xiong, Po-Ting Lai (…)2026-05-20
🧬 biology

GraphPINE: Graph Importance Propagation for Interpretable Drug Response Prediction

تقدم الورقة البحثية GraphPINE، وهي بنية جديدة للشبكات العصبية الرسومية تدمج المعرفة المسبقة الخاصة بالمجال لتهيئة ونشر أهمية العقد بشكل تكراري من أجل تحسين التفسير والأداء في التنبؤ باستجابة السرطان للأدوية.

Yoshitaka Inoue, Tianfan Fu, Augustin Luna2026-05-20
🤖 AI

Slot-MLLM: Object-Centric Visual Tokenization for Multimodal LLM

تقدم هذه الورقة البحثية Slot-MLLM، وهو إطار عمل مبتكر يستخدم أداة ترميز بصري متمحورة حول الكائنات تعتمد على "انتباه الفتحة" (Slot Attention) لتمكين النماذج اللغوية الكبيرة متعددة الوسائط من ترميز وتوليد محتوى بصري تفصيلي على مستوى الكائن بفعالية ضمن نموذج تنبؤ الرمز التالي الموحد.

Donghwan Chi, Hyomin Kim, Yoonjin Oh, Yongjin Kim, Donghoon Lee, Daejin Jo, Jongmin Kim, Junyeob Baek, Sungjin Ahn, Sung (…)2026-05-20
⚡ electrical engineering

Quantifying the Generalization Gap in Seizure Detection: A Large-Scale Empirical Benchmark via the SzCORE Challenge

تقدم هذه الورقة تحدي SzCORE، وهو معيار تجريبي واسع النطاق لتقييم 28 خوارزمية من أحدث خوارزميات الكشف عن النوبات على مجموعة بيانات محجوزة بصرامة لـ 65 مريضاً، مما يكشف عن فجوة تعميم كبيرة وأداء دون المستوى (أعلى درجة F1 هي 32%) يؤكد الحاجة الماسة إلى تقييم معياري وصارم لسد التفاوت بين الفعالية المُبلغ عنها والنشر السريري في العالم الحقيقي.

Jonathan Dan, Amirhossein Shahbazinia, Christodoulos Kechris, David Atienza2026-05-20
🤖 AI

YAC: Bridging Natural Language and Interactive Visual Exploration with Generative AI for Biomedical Data Discovery

تقدم الورقة البحثية نظام YAC، وهو نظام أولي يعمل كجسر بين اللغة الطبيعية والتصورات التفاعلية لاكتشاف البيانات الطبية الحيوية من خلال توظيف بنية متعددة الوكلاء لاستدعاء الأدوات لإنشاء تصورات مرتبطة، وأدوات ضبط، ونصوص تفسيرية، والتي تم تقييمها لاحقاً من خلال دراسة مستخدمين مع خبراء في المجال.

Devin Lange, Shanghua Gao, Pengwei Sui, Priya Misner, Astrid van den Brandt, Austen Money, Nikolay Akhmetov, Lisa Choy (…)2026-05-20
🤖 AI

Jailbreaking on Text-to-Video Models via Scene Splitting Strategy

تقدم هذه الورقة البحثية SceneSplit، وهي طريقة جديدة لكسر الحماية بنظام الصندوق الأسود (black-box jailbreak) تعمل على تجزئة السرديات الضارة إلى مشاهد حميدة فردياً للتلاعب بفضاء المخرجات التوليدية لنماذج تحويل النص إلى فيديو، محققة معدلات نجاح عالية في الهجوم عبر أنظمة متعددة رائدة وكاشفة عن ثغرات حرجة في آليات السلامة الخاصة بها.

Wonjun Lee, Haon Park, Doehyeon Lee, Bumsub Ham, Suhyun Kim2026-05-20