🤖 AI

Constella: Supporting Storywriters' Interconnected Character Creation through LLM-based Multi-Agents

تقدم هذه الورقة "كونستيلا" (Constella)، وهي أداة متعددة الوكلاء تعتمد على النماذج اللغوية الكبيرة (LLM) مصممة لدعم كتاب القصص في إنشاء طواقم شخصيات مترابطة عبر تسهيل اكتشاف الشخصيات ذات الصلة، والاستكشاف المتزامن لعوالمهم الداخلية، وتجسيد علاقاتهم من خلال استجابات الشخصيات المتبادلة.

Syemin Park, Soobin Park, Youn-kyung Lim2026-02-09
🤖 AI

Scaling Multi-Agent Epistemic Planning through GNN-Derived Heuristics

تقترح هذه الورقة إطار عمل للتخطيط المعرفي متعدد الوكلاء وقابل للتوسع يدمج الاستدلالات المستمدة من الشبكات العصبية الرسومية لتوجيه البحث بفعالية عبر هياكل كريبكي المعقدة، مما يحسن أداء الحل بشكل كبير مقارنة بالنماذج المرجعية الحالية.

Giovanni Briglia, Francesco Fabiano, Stefano Mariani2026-02-09
🤖 machine learning

Nash Equilibria in Games with Playerwise Concave Coupling Constraints: Existence and Computation

تثبت هذه الورقة وجود توازنات ناش في الألعاب المقعرة ذات قيود الاقتران المقعرة لكل لاعب باستخدام نظرية النقطة الثابتة الطوبولوجية ورؤى جديدة حول قابلية انكماش المجموعة الممكنة، مع اقتراح خوارزمية صعود التدرج المنظمة بحاجز لوغاريتمي تتقارب إلى توازن تقريبي بمقدار ϵ\epsilon في O(ϵ3)\mathcal{O}(\epsilon^{-3}) من التكرارات لألعاب الإمكانات.

Philip Jordan, Maryam Kamgarpour2026-02-09
💬 NLP

MAGIC: A Co-Evolving Attacker-Defender Adversarial Game for Robust LLM Safety

تقدم هذه الورقة إطار عمل MAGIC، وهو إطار عمل جديد للتعلم المعزز متعدد الوكلاء ومتعدد الجولات يعزز سلامة النماذج اللغوية الكبيرة من خلال لعبة تنافسية مشتركة التطور، حيث يقوم وكيل مهاجم بتوليد استراتيجيات تركيبية مبتكرة ديناميكيًا لكشف الثغرات، مما يدفع وكيل مدافع إلى التعميم والرفض القوي للمدخلات التنافسية غير المرئية.

Xiaoyu Wen, Zhida He, Han Qi, Ziyu Wan, Zhongtian Ma, Ying Wen, Tianhang Zheng, Xingcheng Xu, Chaochao Lu, Qiaosheng Zha (…)2026-02-09
🤖 AI

Communication Enhances LLMs' Stability in Strategic Thinking

تُثبت هذه الورقة أن دمج التواصل قصير المدى وغير المكلف قبل اللعب يعزز بشكل كبير الاستقرار الاستراتيجي والقدرة على التنبؤ في نماذج اللغات الكبيرة صغيرة النطاق في التفاعلات المتكررة بين الوكلاء المتعددين، لا سيما بالنسبة لتلك التي تتميز بتقلب أساسي مرتفع.

Nunzio Lore, Babak Heydari2026-02-09
🤖 AI

Prism: Spectral Parameter Sharing for Multi-Agent Reinforcement Learning

يُعد Prism إطار عمل للتعلم التعزيزي متعدد الوكلاء وقابل للتوسع، حيث يستحث التنوع بين الوكلاء من خلال تمثيل الشبكات المشتركة في المجال الطيفي، حيث يتشارك الوكلاء اتجاهات المتجهات المنفردة ولكنهم يتعلمون أقنعة متميزة على القيم المنفردة، محققاً بذلك أداءً تنافسياً مع كفاءة فائقة في استهلاك الموارد عبر الاختبارات المعيارية المتجانسة وغير المتجانسة.

Kyungbeom Kim, Seungwon Oh, Kyung-Joong Kim2026-02-09
🤖 AI

Sample-Efficient Policy Space Response Oracles with Joint Experience Best Response

تقدم هذه الورقة البحثية "الاستجابة المثلى للتجربة المشتركة" (JBR)، وهي تعديل فعال في استهلاك العينات لأسلوب "أوراكل استجابة فضاء السياسات" (PSRO)، يعمل على تقليل التكاليف الزمنية للتفاعل مع البيئة عبر إعادة استخدام مجموعة بيانات مشتركة واحدة لحساب الاستجابات المثلى لجميع الوكلاء في آن واحد، مما يتيح تعلمًا متعدد الوكلاء قابلاً للتوسع مع التخفيف من تحيز انزياح التوزيع من خلال استراتيجيات محافظة، أو معززة للاستكشاف، أو هجينة.

Ariyan Bighashdel, Thiago D. Simão, Frans A. Oliehoek2026-02-09
🤖 AI

Can Poverty Be Reduced by Acting on Discrimination? An Agent-based Model for Policy Making

تقدم هذه الورقة "نموذج الوكيل القائم على نموذج أبوروفوبيا" (AABM)، الذي يستخدم بيانات واقعية من برشلونة ليوضح حاسوبياً أن التمييز ضد الفقراء (أبوروفوبيا) يؤدي إلى تفاقم عدم المساواة في الثروة، مما يدعو إلى تحولات في السياسات تعالج الفقر كقضية مجتمعية متجذرة في التمييز بدلاً من معالجته فقط من خلال التدابير التقليدية لإعادة التوزيع.

Alba Aguilera, Nieves Montes, Georgina Curto, Carles Sierra, Nardine Osman2026-02-06
⚡ electrical engineering

Steering the Herd: A Framework for LLM-based Control of Social Learning

تقدم هذه الورقة إطاراً لنمذجة كيفية قيام وسطاء المعلومات القائمين على النماذج اللغوية الكبيرة بالتحكم الاستراتيجي في التعلم الاجتماعي للتأثير على القرارات الجماعية، مع إثبات الخصائص النظرية للسياسات المثلى وإظهار قدرة النماذج اللغوية الكبيرة، عبر عمليات المحاكاة، على إبداء سلوكيات استراتيجية ناشئة قادرة على تغيير الرفاه الاجتماعي بشكل كبير حتى في ظل قيود الشفافية.

Raghu Arghal, Kevin He, Shirin Saeedi Bidokhti, Saswati Sarkar2026-02-06