💻 computer science

Scalable Algorithms with Provable Optimality Bounds for the Multiple Watchman Route Problem

تقدم هذه الورقة MWRP-CP3، وهو مخطط أمثل وفعال يستخدم تقليم فضاء الحالة وتحسينات استدلالية لتحقيق تسريع يتجاوز 200 ضعف في حل مسألة مسار الحارس المتعدد، إلى جانب خوارزميات غير مثالية قابلة للتوسع ذات حدود مثالية مثبتة قادرة على التعامل مع خرائط أكبر بثلاث مرات.

Srikar Gouru, Ariel Felner, Jiaoyang Li2026-04-20
💬 NLP

Polarization by Default: Auditing Recommendation Bias in LLM-Based Content Curation

تكشف هذه الدراسة أن تنسيق المحتوى القائم على النماذج اللغوية الكبيرة يضخم الاستقطاب بشكل منهجي ويظهر تحيزات متميزة خاصة بكل مزود فيما يتعلق بالتعامل مع السمية والمشاعر، بينما يفرط باستمرار في تمثيل المؤلفين ذوي التوجه اليساري على تويتر/إكس بغض النظر عن استراتيجيات التلقين المستخدمة.

Nicolò Pagan, Christopher Barrie, Chris Andrew Bail, Petter Törnberg2026-04-20
🤖 AI

Weak-Link Optimization for Multi-Agent Reasoning and Collaboration

تقترح هذه الورقة إطار عمل WORC، وهو إطار عمل ثنائي المراحل يعزز استقرار الاستدلال متعدد الوكلاء باستخدام متنبئ قائم على التعلم الميتا لتحديد الوكلاء الضعفاء واستراتيجية مدفوعة بعدم اليقين لتخصيص ميزانيات استدلال إضافية لهم، مما يؤدي إلى تحسين دقة النظام وإحكام متانة النظام بشكل عام.

Haoyu Bian, Chaoning Zhang, Jiaquan Zhang, Xingyao Li, Yuanfang Guo, Wei Dong, Yang Yang2026-04-20
🤖 AI

SocialGrid: A Benchmark for Planning and Social Reasoning in Embodied Multi-Agent Systems

تقدم الورقة البحثية SocialGrid، وهو معيار تجريبي متعدد الوكلاء متجسد مستوحى من لعبة Among Us، يكشف أن النماذج اللغوية الكبيرة الحالية تعاني بشكل كبير في كل من مهام التخطيط والاستدلال الاجتماعي، لا سيما في كشف الخداع، مع توفير أدوات مثل "أوراكل التخطيط" (Planning Oracle) ومقاييس مؤتمتة لعزل وتشخيص هذه الإخفاقات المحددة.

Hikaru Shindo, Hanzhao Lin, Lukas Helff, Patrick Schramowski, Kristian Kersting2026-04-20
💻 computer science

AstroVLM: Expert Multi-agent Collaborative Reasoning for Astronomical Imaging Quality Diagnosis

يُعد AstroVLM نظاماً تعاونياً متعدد الوكلاء مصمماً لتشخيص جودة الصور الفلكية المعقدة من خلال الاستفادة من التفكير الخبير، وهو ما يتفوق على النماذج المرجعية الحالية في المهام الواقعية.

Yaohui Han, Tianshuo Wang, Zixi Zhao, Zhengchun Zhu, Shuo Ren, Yiru Wang, Rongliang Fu, Tinghuan Chen, Tsung-Yi Ho2026-04-20
💻 computer science

Veritas-RPM: Provenance-Guided Multi-Agent False Positive Suppression for Remote Patient Monitoring

تقدم الورقة البحثية Veritas-RPM، وهي بنية متعددة الوكلاء مكونة من خمس طبقات مصممة لقمع الإيجابيات الكاذبة في مراقبة المرضى عن بُعد من خلال استخدام نهج موجه بالأصل وتصنيف اصطناعي يضم 98 سيناريو للإيجابيات الكاذبة لتحقيق معدلات كبح حقيقية عالية مع تقليل التصعيدات الكاذبة إلى أدنى حد.

Aswini Misro, Vikash Sharma, Shreyank N Gowda2026-04-20
💰 quantitative finance

Implications of zero-growth economics analysed with an agent-based model

تُظهر هذه الدراسة، باستخدام نموذج الوكيل القائم على PG-DYNAMIN، أنه في حين توفر الاقتصادات ذات النمو الصفري استقراراً اقتصادياً كلياً أكبر، ونسب بطالة أقل، وديوناً شركاتية منخفضة مقارنة بسيناريوهات النمو، إلا أنها تنطوي أيضاً على تضخم أعلى، وزيادة في التركز السوقي، وأزمات أكثر حدة مع احتمالات أعلى لتعثر الشركات.

Dylan C. Terry-Doyle, Adam B. Barrett2026-04-17
💬 NLP

Theory of Mind in Action: The Instruction Inference Task in Dynamic Human-Agent Collaboration

تقدم هذه الورقة "مهمة استنتاج التعليمات" (Instruction Inference Task) و"تومكات" (Tomcat)، وهو وكيل يعتمد على النماذج اللغوية الكبيرة ومصمم لممارسة "نظرية العقل" عبر استنتاج النوايا غير المعلنة من التعليمات الغامضة، مما يثبت أن المتغيرات التي تستخدم تسلسل الأفكار في سياق التعلم من أمثلة قليلة تحقق أداءً مماثلاً لأداء البشر في التعاون الديناميكي بين الإنسان والوكيل.

Fardin Saad, Pradeep K. Murukannaiah, Munindar P. Singh2026-04-17
💬 NLP

Don't Retrieve, Navigate: Distilling Enterprise Knowledge into Navigable Agent Skills for QA and RAG

تقدم الورقة البحثية Corpus2Skill، وهي طريقة تحول مجموعات الوثائق إلى أشجار مهارات هرمية وقابلة للتنقل لتمكين وكلاء النماذج اللغوية الكبيرة من الاستكشاف والاستنتاج بنشاط حول هياكل المعرفة المؤسسية، مما يؤدي إلى التفوق على النهج التقليدية القائمة على الاسترجاع في معايير اختبار الأسئلة والأجوبة.

Yiqun Sun, Pengfei Wei, Lawrence B. Hsieh2026-04-17
💻 computer science

FedGUI: Benchmarking Federated GUI Agents across Heterogeneous Platforms, Devices, and Operating Systems

تقدم هذه الورقة FedGUI، وهو أول معيار شامل مصمم لتقييم وكلاء واجهة المستخدم الرسومية (GUI) الموزعين عبر منصات الهاتف المحمول والويب وسطح المكتب غير المتجانسة، مما يوفر مجموعات بيانات منسقة ورؤى رئيسية حول كيفية تأثير التعاون عبر المنصات وعوامل عدم التجانس المحددة على أداء الوكيل.

Wenhao Wang, Haoting Shi, Mengying Yuan, Yiquan Lin, Panrong Tong, Hanzhang Zhou, Guangyi Liu, Pengxiang Zhao, Yue Wang (…)2026-04-17