🤖 machine learning

Interaction-Breaking Adversarial Learning Framework for Robust Multi-Agent Reinforcement Learning

تقترح هذه الورقة إطار عمل "التعلم التنافسي لكسر التفاعل" (IBAL)، الذي يستخدم نهجاً قائماً على نظرية المعلومات لتوليد هجمات تعطل التفاعلات بين الوكلاء والدفاع ضدها، مما يعزز بشكل كبير من متانة وتنسيق أنظمة التعلم التعزيزي متعددة الوكلاء في ظل الاضطرابات المتنوعة وسيناريوهات فقدان الوكلاء.

Sunwoo Lee, Mingu Kang, Yonghyeon Jo, Seungyul Han2026-05-19
💬 NLP

PROTEA: Offline Evaluation and Iterative Refinement for Multi-Agent LLM Workflows

تُعد PROTEA واجهة موحدة للتحسين القائم على الاختبار غير المتصل بالإنترنت لسير عمل النماذج اللغوية الكبيرة متعددة الوكلاء، والتي تعمل على تحديد مواضع الاختناق محلياً من خلال التقييم القائم على الرسوم البيانية والتقييم العكسي، مما يمكّن المطورين من تحرير والتحقق من مراجعات الأوامر البرمجية بشكل تكراري لتحسين أداء النظام بشكل كبير.

Kazuki Kawamura, Satoshi Waki, Kei Tateno2026-05-19
🤖 machine learning

New Insight of Variance reduce in Zero-Order Hard-Thresholding: Mitigating Gradient Error and Expansivity Contradictions

تقترح هذه الورقة خوارزمية عتبة صلبة من الدرجة الصفرية عامة لتقليل التباين، تعالج الصراع المتأصل بين انحراف التدرج وتوسع المؤثر في طريقة SZOHT الحالية، مما يؤدي إلى إزالة القيود على الاتجاهات العشوائية وتحقيق معدلات تقارب محسنة وقابلية تطبيق أوسع لتحسين 0\ell_0.

Xinzhe Yuan (Harbin Institute of Technology), William de Vazelhes (Mohamed bin Zayed University of Artificial Intelligen (…)2026-05-19
💻 computer science

Confidence-Gated Robot Autonomy: When Does Uncertainty Actually Help?

تُظهر هذه الورقة أنه في حين أن آليات البوابات القائمة على عدم اليقين غير فعالة في اكتشاف الجدة الدلالية، فإن مؤشرات عدم اليقين البسيطة تصبح كافية لاتخاذ قرارات ذاتية موثوقة بمجرد وصول النموذج الأساسي إلى عتبة أداء كفء، وعند هذه النقطة يصبح اختيار العتبة أكثر أهمية من طريقة تقدير عدم اليقين المحددة.

Johannes A. Gaus, Jhon P. F. Charaja, Daniel Haeufle2026-05-19
💻 computer science

DocOS: Towards Proactive Document-Guided Actions in GUI Agents

تُقدم الورقة البحثية "الإجراء الاستباقي الموجه بالوثائق" (Proactive Document-Guided Action) وتقترح معيار "DocOS" لمعالجة أوجه القصور في وكلاء واجهة المستخدم الرسومية (GUI agents) عند التعامل مع المهام نادرة الحدوث، وذلك من خلال تمكينهم من البحث ذاتياً عن الوثائق الخارجية وتأصيلها في إجراءات قابلة للتنفيذ، مما يكشف أن التقدم الحالي يعوقه تحديات في استرجاع المعلومات وتأصيل التعليمات.

Jingjing Liu, Ziye Huang, Zihao Cheng, Zeming Liu, Jiahong Wu, Yuhang Guo, Kehai Chen, Yunhong Wang, Haifeng Wang2026-05-19
🤖 machine learning

FLAG: Foundation model representation with Latent diffusion Alignment via Graph for spatial gene expression prediction

تقدم الورقة البحثية إطار العمل FLAG، وهو إطار عمل قائم على الانتشار يستفيد من مشفر رسومي مكاني ومحاذاة نموذج تأسيسي جيني للتغلب على "لعنة البعد الجيني" والتنبؤ بدقة بالتعبير الجيني المكاني من صور صبغة الهيماتوكسيلين والإيوسين (H&E) من خلال الحفاظ على العلاقات الجينية-الجينية والعلاقات الهيكلية المكانية الأساسية.

Qi Si, Penglei Wang, Yushuai Wu, Yifeng Jiao, Xuyang Liu, Xin Guo, Yuan Qi, Yuan Cheng2026-05-19
🤖 machine learning

Improving Spatio-Temporal Residual Error Propagation by Mitigating Over-Squashing

تقدم هذه الورقة البحثية "Teger"، وهو نموذج هيكلي لعدم اليقين غير مرتبط بهيكل أساسي، يعمل على التخفيف من انتشار الخطأ المتبقي المكاني-الزماني وظاهرة "الضغط الزائد" (over-squashing) في النماذج المتكررة عبر توظيف آلية إعادة صياغة للرسوم البيانية تعتمد على انحناء "فورمان" المنفصل ضمن رأس تغاير منخفض الرتبة مضاف إليه قطر، مما يؤدي إلى تحسين أداء التنبؤ الاحتمالي طويل الأمد بشكل كبير.

Seyed Mohamad Moghadas, Esther Rodrigo Bonet, Bruno Cornelis, Adrian Munteanu2026-05-19
🤖 machine learning

LLM-Guided Communication for Cooperative Multi-Agent Reinforcement Learning

تقترح الورقة البحثية إطار عمل LMAC، وهو إطار عمل مبتكر يسخر النماذج اللغوية الكبيرة لتصميم وتحسين بروتوكولات الاتصال بشكل تكراري، مما يمكن الأنظمة متعددة الوكلاء التعاونية من إعادة بناء الحالات الأساسية بدقة وتجانس أكبر، وبالتالي التفوق بشكل كبير على النماذج المرجعية الحالية في مختلف الاختبارات المعيارية.

Sangjun Bae, Yisak Park, Sanghyeon Lee, Seungyul Han2026-05-19
⚛️ quantum physics

Parameterized 4-Qubit EWL Quantum Game Circuits with Dirac-Solow-Swan Hamiltonian Integration for Quadruple Helix Disruptive Innovation Recommender Systems

تقترح هذه الورقة دائرة لعبة كمومية من نوع EWL مكونة من 4 كيوبتات ومعلمية ومتوافقة مع عصر الـ NISQ، تدمج بيانات التمويل الواقعية من قاعدة بيانات CORDIA مع هاميلتوني ديريك-سولو-سوان لنمذجة والتنبؤ بمسارات الابتكار المزعزع ضمن أنظمة اللولب الرباعي البيئية.

Agung Trisetyarso, Fithra Faisal Hastiadi, Kridanto Surendro2026-05-19
📊 statistics

Symmetry-Compatible Principle for Optimizer Design: Embeddings, LM Heads, SwiGLU MLPs, and MoE Routers

تقدم هذه الورقة مبدأً متوافقاً مع التماثل لتصميم المحسنات، يربط قواعد تحديث التدرج بهياكل التكافؤ المحددة لكتل المعلمات المختلفة — مثل التضمينات (embeddings)، ورؤوس النماذج اللغوية الكبيرة (LM heads)، وطبقات (SwiGLU MLPs)، وموجهات (MoE routers) — مُثبتةً من خلال تجارب ما قبل التدريب المكثفة أن هذه المحسنات المصممة خصيصاً تتفوق باستمرار على (AdamW) في خسارة التحقق النهائية واستقرار التدريب.

Tim Tsz-Kit Lau, Weijie Su2026-05-19