💻 computer science

The Best-Laid SCHEMEs: Coordinated Sabotage and Monitoring in Multi-Agent Systems

تقدم هذه الورقة معيار SCHEME لإثبات أن أنظمة البرمجة المتقدمة متعددة الوكلاء يمكنها تنسيق التخريب الخفي بفعالية أثناء إكمال المهام المشروعة، رغم أن مثل هذا التنسيق الخبيث يظل قابلاً للكشف بدرجة عالية من خلال مراقبة تعديلات الكود والاتصالات، لا سيما عندما يكون الوكلاء على دراية بالمراقبة.

Nikolay Radev, Lennart Haas, Benjamin Arnav, Pablo Bernabeu-Pérez2026-05-29
🤖 machine learning

DynaGraph: Lightweight Multi-Model Interaction Framework via Dynamic Topological Reconfiguration

تُعد DynaGraph إطار عمل خفيف الوزن متعدد النماذج يستخدم إعادة التشكيل الطوبولوجي الديناميكي ومهايئات الضبط الدقيق للنماذج الأساسية (PEFT) القائمة على تقسيم الوقت على نموذج أساسي مشترك لتحقيق قدرات استدلال بمستوى 72 مليار معلمة، مع تقليل زمن الاستجابة واستهلاك الرموز (tokens) بشكل كبير، وتجاوز قيود خطوط الإمداد الثابتة والوكلاء الديناميكيين غير المقيدين.

Yanxing Guo, Zihao Zheng, Fangzhou Wu, Ling Liang, Lin Bao, Zongwei Wang, Yimao Cai2026-05-29
💻 computer science

AgentCVR: Active Multi-Agent Cross-Video Reasoning via Script-Simulated Reinforcement Learning

تقدم هذه الورقة البحثية AgentCVR، وهو إطار عمل متعدد الوكلاء يعالج أوجه القصور في استراتيجيات المرور الواحد في الاستدلال عبر الفيديوهات من خلال توظيف "وكيل رئيسي" لتنسيق وكلاء بصريين وصوتيين متخصصين بشكل تكراري للحصول على أدلة مستهدفة، مستفيداً من نهج مبتكر للتعلم التعزيزي المحاكي للسيناريو لتحسين كفاءة التدريب مع تحقيق أداء رائد.

Yilun Qiu, Jiahe Wang, Cilin Yan, Jiayin Cai, Xiaolong Jiang, Yao Hu, Chun Yuan2026-05-29
🤖 AI

Why Specialist Models Still Matter: A Heterogeneous Multi-Agent Paradigm for Medical Artificial Intelligence

تقترح هذه الورقة البحثية HetMedAgent، وهو إطار عمل متعدد الوكلاء غير متجانس ينظم التعاون بين النماذج اللغوية الكبيرة العامة، والنماذج المتخصصة في مجالات محددة، والأطباء، لإثبات أن النماذج المتخصصة تظل لا غنى عنها لتحقيق اتخاذ قرارات طبية فائقة من خلال دمج الأدلة والإدارة التكيفية لعدم اليقين.

Yanan Wang, Shuaicong Hu, Jian Liu, Guohui Zhou, Aiguo Wang, Cuiwei Yang2026-05-29
🤖 AI

Evolutionary Dynamics of Cooperation in Next-Generation LLM Agent Systems: A Cross-Provider Empirical Extension

توسع هذه الدراسة معايير نظرية الألعاب التطورية لتشمل أربعة من وكلاء النماذج اللغوية الكبيرة الرائدة من الفترة ٢٠٢٥-٢٠٢٦، كاشفةً أنه في حين تستمر الانحيازات التعاونية عبر معظم النماذج، فإن هوية المزود تؤثر بشكل كبير على نتائج التوازن، كما يظل الصمود أمام الضجيج تحدياً عالمياً رغم التحسينات الجزئية في تكافؤ القدرة الهجومية.

Francisco León Zúñiga Bolívar (Institución Universitaria Colegio Mayor del Cauca)2026-05-29
🤖 AI

AgentSchool: An LLM-Powered Multi-Agent Simulation for Education

تقدم هذه الورقة البحثية AgentSchool، وهو محاكي متعدد الوكلاء مدعوم بنماذج اللغات الكبيرة (LLM) يعمل على نمذجة التعلم كتحولات في الحالة بدلاً من تقمص الأدوار للتغلب على العوائق الأخلاقية واللوجستية للتجارب التعليمية في العالم الحقيقي، مما يتيح دراسة النمو المعرفي، والديناميكيات الاجتماعية، والاستدلال المؤسسي من خلال وكلاء طلاب ومعلمين قابلين للضبط.

Yulei Ye, Wenhao Li, Zhong Wen, Yunshu Huang, Yichen Hu, Zifan Wei, Yige Wang, Xinyu Xie, Haoxuan Yang, Yanjun Huang, Ru (…)2026-05-29
🤖 AI

Unifying Temporal and Structural Credit Assignment in LLM-Based Multi-Agent Prompt Optimization

تقترح هذه الورقة إطار عمل مبتكر لتحسين الأنظمة متعددة الوكلاء القائمة على النماذج اللغوية الكبيرة، والذي يعالج تحديات عدم القابلية للاشتقاق والاشراف المتناثر عبر تقديم آليات تخصيص ائتمان زمنية وهيكلية لتوجيه خوارزمية تنازل إحداثي كتلوي لفظي منفصل من أجل تحسين مستهدف وفعال للمطالبات.

Wenwu Li, Yuran Song, Mingze Zhao, Bo Jin, Wenhao Li2026-05-29
💻 computer science

EASE Configuration Facilitates A Reproducible Science of LLM Social Simulations

تقدم هذه الورقة البحثية EASE، وهو إطار عمل معياري لتوحيد المحاكاة الاجتماعية القائمة على النماذج اللغوية الكبيرة (LLM) لتعزيز قابلية التكرار، وتبرهن على فائدته من خلال منصة SiliSocS مفتوحة المصدر وثلاث دراسات حالة تكشف عن تأثيرات خيارات التصميم على نتائج المحاكاة.

Sneheel Sarangi, Maximilian Puelma Touzel, Aurélien Bück-Kaeffer, Zachary Yang, Jean-François Godbout, Reihaneh Rabbany2026-05-29
💻 computer science

SpecBench: Evaluating Specification-Level Reasoning for Software Engineering LLM Agents

تقدم هذه الورقة SpecBench، وهو معيار مرجعي جديد يقيم قدرة وكلاء هندسة البرمجيات على تحديد العيوب وتحسين مواصفات الأنظمة غير المكتملة أو الغامضة من خلال التفكير بمستوى الخبراء، مما يعالج فجوة حرجة تركتها المعايير المرجعية الحالية التي تركز على توليد الكود.

Grant Hamblin, Kevin Song, Zhanda Zhu, Anand Jayarajan, Sihang Liu, Nandita Vijaykumar, Gennady Pekhimenko2026-05-29
⚡ electrical engineering

Long-Term Mapping of the Douro River Plume with Multi-Agent Reinforcement Learning

تقترح هذه الورقة إطار عمل لتعلم تعزيزي متعدد الوكلاء يتسم بكفاءة الطاقة والاتصال، يدمج انحدار العملية الغاوسية الزمكاني مع منسق مركزي، لرسم خريطة لانتشار نهر دورو عبر عدة أيام بفعالية، مما يظهر دقة وقابلية توسع فائقتين مقارنة بالمعايير المرجعية الحالية.

Nicolò Dal Fabbro, Milad Mesbahi, Renato Mendes, João Borges de Sousa, George J. Pappas2026-05-28