💻 computer science

A Comparative Study of MCP and A2A for Inter-Agent Coordination in LLM-Based Systems

تقدم هذه الورقة مقارنة تجريبية بين بروتوكول سياق النموذج (MCP) وبروتوكول العميل للعميل (A2A) للتنسيق بين الوكلاء، حيث كشفت أن بروتوكول (MCP) يقدم نهجاً خفيف الوزن ومنخفض التعقيد يتطلب إدارة صريحة للحالة على مستوى طبقة التطبيقات، في حين يوفر بروتوكول (A2A) دعماً أصيلاً أغنى للتفاعلات متعددة الأدوار وحاملة للحالة على حساب تعقيد تنفيذي أعلى بكثير.

Ionut Predoaia, Tuong Manh Vu, Konstantinos Barmpis, Dimitris Kolovos, Antonio García-Domínguez2026-07-28
🤖 AI

Embodiment-Induced Coordination Regimes in Tabular Multi-Agent Q-Learning

تُظهر هذه الورقة أنه في التعلم المعزز متعدد الوكلاء ذي الجداول الكاملة مع قيود التجسد، يتفوق تعلم Q المستقل بالكامل على النهج المركزية من خلال تجنب "قفل التزامن الزمني"، وهو اعتلال تنسيقي تجبر فيه دوال القيمة المشتركة الوكلاء الأكفاء على فترات انتظار دون المستوى الأمثل عندما يكون الشركاء محدودين.

Muhammad Ahmed Atif, Nehal Naeem Haji, Mohammad Shahid Shaikh, Muhammad Ebad Atif2026-07-27
💻 computer science

Draining the Energy Commons: Self-Defeating Over-Appropriation as a Coordination Failure in Agentic LLM Collectives

تُثبت هذه الورقة أن مجموعات النماذج اللغوية الكبيرة الوكيلية التي تتشارك موارد الطاقة المتجددة تُظهر فشلاً في التنسيق ذاتي الهزيمة، حيث تفرط في استغلال الموارد المشتركة في ظل الندرة لتعظيم الاستمرارية الفورية، مما يؤدي إلى استنزاف الاحتياطي وتقويض الخدمة المستقبلية رغم وجود استراتيجيات مستدامة.

Marcantonio Bracale Syrnicov, Federico Pierucci, Matteo Prandi, Marcello Galisai, Piercosma Bisconti, Francesco Giarruss (…)2026-07-27
🤖 AI

TRACE-ROUTER: Task-Consistent and Adaptive Online Routing for Agentic AI

يُعد TRACE-Router إطار عمل للتوجيه على مستوى المهام يقوم بتعيين سير العمل الوكيل إلى نموذج لغوي كبير واحد عند الاستقبال، ويقوم بتحديث السياسات بناءً على مكافآت متأخرة على مستوى المهمة، مما يجعله يتفوق على الموجهات الحالية لكل استدعاء من حيث المقايضة بين الدقة وزمن الاستجابة عبر معايير متعددة.

Ritik Raj, Souvik Kundu, Sarbartha Banerjee, Dheemanth Joshi, Ishita Vohra, Tushar Krishna2026-07-27
💻 computer science

Social Reasoning in Machines: Investigating Collective Truth-Seeking Dynamics in Large Language Model Debate

تُثبت هذه الورقة أن محاكاة نظرية الحوار الاستدلالي من خلال مناظرات متعددة الوكلاء بين نماذج لغوية كبيرة متنوعة تعزز بشكل كبير أداء البحث عن الحقيقة الجماعي، وتوفر منهجية قياس ديناميكية مبتكرة لتقييم الخصائص الجوهرية للنماذج مثل الهلوسة.

Tom Pecher2026-06-01
🤖 AI

Healthcare Mechanisms from Policy-as-Code Search under Strategic Provider Response

تعيد هذه الورقة صياغة تصميم آليات الرعاية الصحية كمسألة تركيب برامج باستخدام بحث تطوري موجه بنماذج لغوية كبيرة وبحث محاكي متعدد الوكلاء (Medi-Sim) لنمذجة استجابات مقدمي الخدمة الاستراتيجية ديناميكيًا، مما نجح في تركيب آلية قائمة على القواعد قابلة للفحص تقضي على التشفير الزائد وتحد من رفض المرضى مع الحفاظ على الجدوى المالية.

Zihan Wang, Xiang Xu, Hongyuan Zha, Wenhao Li2026-06-01
🤖 AI

Seeing Before Agreeing: Aligning Multi-Agent Consensus with Visual Evidence

تقترح الورقة البحثية إطار عمل EAGLE، وهو إطار عمل متعدد الوكلاء لا يتطلب تدريباً، يعزز الإجماع في نماذج الرؤية واللغة من خلال إعطاء الأولوية للأدلة البصرية المتوافقة على مجرد الاتفاق على الإجابة، مما يحقق أداءً فائقاً وقابلاً للتفسير عبر مختلف معايير اختبار الأسئلة المرئية والإجابة عنها (VQA).

Yuhan Wang, Shuochen Chang, Yalin Feng, Dongsheng Ma, Yuanzi Li, Zhengren Wang, Yinglong Yang, Yufei Chen, Yikang Wang (…)2026-06-01
🤖 AI

Design and Evaluation of Multi-Agent AI Oracle Systems for Prediction Market Resolution

تقيم هذه الورقة أنظمة "أوراكل" للذكاء الاصطناعي متعددة الوكلاء لحل أسواق التنبؤ، حيث وجدت أنه بينما يتفوق التجميع المستقل الموزون بالثقة قليلاً على النماذج المرجعية ذات النموذج اللغوي الكبير الواحد، فإن الإجماع التداولي يؤدي إلى تدهور الأداء بسبب انتشار الأخطاء، مما يدفع في النهاية نحو استراتيجية توجيه هجينة تحقق دقة بنسبة 97.87% عبر الحل التلقائي للحالات المتوافقة ذات الثقة العالية فقط وتصعيد حالات الخلاف إلى المراجعة البشرية.

Tarun Kota2026-06-01
🤖 AI

Safe Equilibrium Policy Optimization for Strategic Agent Policies

تقدم هذه الورقة البحثية "تحسين سياسة التوازن الآمن" (SEPO)، وهو هدف تدريب يعزز العائد المتوقع بفرض عقوبات على القابلية للاستغلال، والتواطؤ، والآثار الخارجية للتخفيف من أنماط الفشل الاستراتيجي في وكلاء النماذج اللغوية، مما يظهر تحسناً في السلامة وأداء التوازن عبر خمسة مجالات استراتيجية عند تطبيقه على نماذج Gemma وQwen عبر "تحسين السياسة النسبي الجماعي" (GRPO).

Karthika Arumugam, Kiran Kumar Manku, Amit Dhanda2026-06-01
📈 economics

Comparing Market Mechanism Efficiencies

تستخدم هذه الورقة إطار عمل لانتظار الدور قائم على نظرية الألعاب لتوضيح أن سجلات الأوامر غير الشفافة (المجمعات المظلمة) تحقق رفاهية إجمالية مسبقة متفوقة مقارنة بالبورصات العلنية ومزادات الدفعات الدورية، وذلك من خلال القضاء على ألعاب التوقيت الاستراتيجية المهدرة المتأصلة في سجلات الأوامر الشفافة.

Irene Aldridge2026-06-01