⚡ electrical engineering

Noncooperative Virtual Queue Coordination via Uncertainty-Aware Correlated Equilibria

تقترح هذه الورقة آلية تنسيق غير تعاونية، قابلة للتوسع ومدركة لعدم اليقين، قائمة على توازن الارتباط المقيد بالاحتمالات، لتحسين إدارة ازدحام سطح المطارات من خلال تزويد شركات الطيران بتوصيات دفع للخلف متوافقة مع الحوافز تحترم استقلاليتها مع تقليل التأخيرات المتراكمة.

Jaehan Im, David Fridovich-Keil, Ufuk Topcu2026-02-17
🤖 machine learning

Fluid-Agent Reinforcement Learning

تقدم هذه الورقة إطار عمل "الوكيل السائل" للتعلم التعزيزي متعدد الوكلاء الذي يُمكّن الوكلاء من استدعاء وكلاء جدد ديناميكيًا، مقترحةً حلولاً قائمة على نظرية الألعاب ومثبتةً من خلال التجارب أن هذا النهج يسمح للفرق بتكييف حجمها مع المتطلبات البيئية واكتشاف استراتيجيات مبتكرة تتجاوز إعدادات التعداد الثابت.

Shishir Sharma, Doina Precup, Theodore J. Perkins2026-02-17
🤖 machine learning

Picking the Right Specialist: Attentive Neural Process-based Selection of Task-Specialized Models as Tools for Agentic Healthcare Systems

تقدم هذه الورقة ToolSelect، وهو مُنتقٍ قائم على العمليات العصبية الانتباهية (Attentive Neural Process) يختار بشكل تكيفي النموذج الأمثل المتخصص في المهام من مجمع غير متجانس للأنظمة الصحية الوكيلية، وقد تم التحقق من صحته من خلال ToolSelectBench المنشأ حديثاً على بيئة شاملة للأشعة السينية للصدر.

Pramit Saha, Joshua Strong, Mohammad Alsharid, Divyanshu Mishra, J. Alison Noble2026-02-17
💻 computer science

Learning Large-Scale Competitive Team Behaviors with Mean-Field Interactions and Online Opponent Modeling

تقدم هذه الورقة MF-MAPPO، وهو امتداد حقل متوسط (mean-field) قابل للتوسع لخوارزمية PPO مصمم لألعاب الفرق ذات المجموع الصفري واسعة النطاق، يجمع بفعالية بين التعاون داخل الفريق والمنافسة بين الفرق، متفوقاً على الأساليب الحالية في البيئات المعقدة ذات الإدراك الجزئي من خلال نمذجة الخصم عبر الإنترنت والتدريب المنظم بالتدرج.

Bhavini Jeloka, Yue Guan, Panagiotis Tsiotras2026-02-16
🤖 AI

OptiML: An End-to-End Framework for Program Synthesis and CUDA Kernel Optimization

إن OptiML هو إطار عمل متكامل يقوم بتوليد وتحسين نوى CUDA عالية الأداء من خلال الجمع بين مولد "خليط من الأفكار" (Mixture-of-Thoughts) للتوليف الأولي، ومحسن قائم على البحث يستخدم بحث شجرة مونت كارلو (Monte Carlo Tree Search) وتغذية راجعة من أداة تحليل الأداء العتادي لتنقيح الكود بشكل منهجي لتحقيق أقصى قدر من الأداء.

Arijit Bhattacharjee, Heng Ping, Son Vu Le, Paul Bogdan, Nesreen K. Ahmed, Ali Jannesari2026-02-16
⚡ electrical engineering

Interference-Robust Non-Coherent Over-the-Air Computation for Decentralized Optimization

تقترح هذه الورقة مخططاً للاتصال عبر الهواء غير المتماسك والمقاوم للتداخل (IR-NCOTA) يستخدم تدوير الإطارات العشوائي المنسق والإشارات المرجعية شبه العشوائية لتحويل التداخل الخارجي إلى توزيع بمتوسط صفري، مما يحافظ على تقديرات الإجماع غير المنحازة ويضمن التقارب في مهام التحسين اللامركزي.

Nicolò Michelusi2026-02-16
💻 computer science

Theory of Mind Guided Strategy Adaptation for Zero-Shot Coordination

تقترح هذه الورقة وكيلًا تجميعيًا تكيفيًا موجهًا بنظرية العقل يستنتج نوايا الزميل لاختيار السياسة الأكثر ملاءمة من بين مجموعة تجميعية بشكل ديناميكي، مما يحقق أداءً فائقًا في التنسيق صفري الاستباق (zero-shot coordination) في بيئة "أوفر كوكد" (Overcooked) مقارنة بنماذج الاستجابة المثلى الثابتة.

Andrew Ni, Simon Stepputtis, Stefanos Nikolaidis, Michael Lewis, Katia P. Sycara, Woojun Kim2026-02-16
🤖 AI

Bench-MFG: A Benchmark Suite for Learning in Stationary Mean Field Games

تقدم هذه الورقة Bench-MFG، وهي مجموعة اختبار شاملة تتميز بتصنيف للمشكلات، وتوليد عشوائي للحالات، وخوارزميات تعلم متنوعة لتوحيد تقييم ومقارنة الأساليب في ألعاب المجال المتوسط ذات الزمن المنفصل والمكان المنفصل والساكنة.

Lorenzo Magnino, Jiacheng Shen, Matthieu Geist, Olivier Pietquin, Mathieu Laurière2026-02-16
💻 computer science

Normative Feeling: Socially Patterned Affective Mechanisms

تستخدم هذه الورقة النمذجة القائمة على الوكلاء لتوضيح أن آليات العقاب المعياري، بخلاف التنافس الصرف، تدفع نحو تطور استجابات عاطفية قائمة على المزاج تعمل كإشارات اجتماعية ضمنية لتعزيز حفظ الموارد وترسيخ الأنماط الثقافية في الاستعدادات النفسية.

Stavros Anagnou, Daniel Polani, Christoph Salge2026-02-13
🤖 AI

Parallelism Meets Adaptiveness: Scalable Documents Understanding in Multi-Agent LLM Systems

تقترح هذه الورقة إطار عمل متعدد الوكلاء يعتمد على النماذج اللغوية الكبيرة وقابل للتوسع، يعمل على تعزيز فهم المستندات في المجالات المعقدة من خلال دمج التوجيه الديناميكي للمهام، والتغذية الراجعة ثنائية الاتجاه، والمنافسة المتوازية بين الوكلاء للتغلب على قيود سير العمل الثابت.

Chengxuan Xia, Qianye Wu, Sixuan Tian, Yilun Hao2026-02-13