💬 NLP

Social Gym and SPaRTan: Benchmarking and Improving LLM Social Reasoning via Multi-Agent Game Tournaments

تقدم هذه الورقة Social Gym، وهو معيار ألعاب متعدد الوكلاء قابل للتحقق لتقييم الاستدلال الاجتماعي للنماذج اللغوية الكبيرة بشكل موضوعي، وSPaRTan، وهو إطار عمل للتحسين الذاتي لا يتطلب تدريباً يستفيد من التأمل وكتيبات اللعب القابلة للنقل لتعزيز الأداء في أدوار ألعاب محددة دون الحاجة إلى تحديث أوزان النموذج.

Keyu He, Xuhui Zhou, Maarten Sap2026-08-11
🤖 machine learning

Multi-Agent AI Safety as an Institutional Design Problem

تقدم هذه الورقة برنامج البحث "POLIS" وتقدم دراسة تجريبية واسعة النطاق تثبت أن سلامة الذكاء الاصطناعي متعدد الوكلاء هي في جوهرها مشكلة تصميم مؤسسي، حيث يؤثر التكوين المحدد للقواعد، وحالات السلطة، ومسارات ما بعد الحظر بشكل كبير على السلوك الجماعي ومعدلات الانتهاك، وغالبًا ما يكون ذلك تأثيرًا أكبر من القواعد نفسها.

Abdullah X2026-08-11
📈 economics

Competitive mediator games and urban CAV routing markets

تقدم هذه الورقة ألعاب الوساطة التنافسية لنمذجة أسواق التوجيه والقيادة الذاتية المستقبلية، حيث تثبت أنه في إعدادات الازدحام المجهولة العامة، يؤدي الوسطاء الذين يسعون لتعظيم حصتهم في السوق إلى توازنات احتكارية عندما يكون وسيط واحد مفضلاً بشكل عالمي، مع تقديم نظرة عامة شاملة ومناقشة لتصميم الآليات لهذه الأسواق الناشئة.

Grzegorz Jamróz2026-08-11
🤖 AI

Evaluating XAI Support From A Hierarchical Reinforcement Learning Policy in Human-Agent Collaboration

تقدم هذه الورقة أول تقييم منهجي للتعلم التعزيزي الهرمي القابل للتفسير جوهرياً في التعاون بين الإنسان والوكيل باستخدام معيار Overcooked-AI، كاشفةً أنه بينما أظهرت التفسيرات اتجاهات نحو تحسن أسرع، فإن التفسيرات المقدمة عبر الصوت قد قوضت بشكل كبير التحالف العملي بين الإنسان والوكيل من خلال خلق توقعات شراكة غير ملباة.

Mateus Levi Simões Fernandes, Alberto Sardinha2026-08-10
🤖 AI

Scalable Long-Horizon Planning with Staggered Updates for Lifelong MAPF

تقدم الورقة البحثية PUSH، وهو مخطط مسارات متعدد الوكلاء طويل الأمد وقابل للتوسع يحقق إنتاجية عالية وتنسيقاً طويل الأمد لآلاف الوكلاء على خرائط عامة من خلال الجمع بين التخطيط للمجموعات الفرعية المتدرجة وتحديثات المسار النافذة وحل النزاعات المستوحى من EPIBT.

Vaibhav Sanjay, Jiaoyang Li2026-08-10
💻 computer science

Learning Long-Term Educational Investment Policies under Residential Sorting

تقترح هذه الورقة إطار عمل ديناميكي متعدد الوكلاء باستخدام التعلم المعزز لتحسين سياسات الاستثمار في المدارس الحكومية على المدى الطويل، مع مراعاة التوزيع السكني وردود فعل سوق الإسكان، مما يظهر فعالية وتكافؤاً متفوقين مقارنة بالنهج القائمة.

Honglei Guo, Shuo Chen, Mingjie Bi, Zeyang Sun, Xiaoxi Wang, Yuhan Zhao2026-08-10
💻 computer science

Spatial community structure impedes language amalgamation in a population-based iterated learning model

توسع هذه الورقة نموذج التعلم المتكرر ليشمل مجتمعاً مدمجاً مكانياً، مظهرةً أنه في حين يمكن للتواصل المحدود بين المجتمعات أن يدفع نحو التقارب اللغوي، فإن البنية المكانية تعيق بشكل كبير اندماج لغة عالمية واحدة.

George Sains, Conor Houghton, Seth Bullock2026-08-07
💻 computer science

The Condorcet Dimension of Metric Spaces

تثبت هذه الورقة أنه في الفضاءات المترية ثنائية الأبعاد ذات معايير مانهاتن أو اللانهاية، يكون بُعد كوندورسي للانتخابات القائمة على التقارب محدودًا بـ 4، بينما تُظهر أيضًا أن أي مجموعة من تفضيلات الناخبين يمكن تضمينها في فضاء متري عالي الأبعاد لأي معيار pp.

Alexandra Lassota, Adrian Vetta, Bernhard von Stengel2026-08-07
🤖 AI

DoctorAgents: an agentic framework to iteratively refine AutoML pipeline for small clinical temporal data

يُعد DoctorAgents إطار عمل للذكاء الاصطناجِي (agentic AI) يستفيد من نماذج لغوية كبيرة متخصصة لتطوير مسارات تعلم الآلة السريرية بشكل تكراري من خلال تحديثات قائمة على الاستدلال وتغذية راجعة بلغة طبيعية، متفوقاً بذلك على أنظمة التعلم الآلي الآلي (AutoML) التقليدية في التعامل مع البيانات الزمنية الصغيرة وغير المتجانسة.

Ruilin Wang, Bo-Hong Wang, Elizabeth Kourbatski, Jun Bai, Hegang Chen, Ziyang Song, Gilles Boire, Marie Hudson, Yue Li2026-08-07
🤖 AI

F2^2Agent: Financial Fusion of Agentic Intelligence for Multimodal Trading

يُعد F2^2Agent إطار عمل تداول متعدد الوسائط ومبتكرًا يستفيد من تسلسل هرمي من الوكلاء المتخصصين وآلية دمج تكيفية قوية تجاه الضجيج لالتقاط التبعيات عبر الوسائط بفعالية، مما يتفوق بشكل كبير على النماذج المرجعية الحالية في العوائد السنوية عبر مختلف الأصول المالية.

Changshuo Liu, Yanzheng Jin, Shangfeng Cai, Peng Fang, Xiaokui Xiao, Beng Chin Ooi2026-08-07