🤖 AI

AutoClimDS: Climate Data Science Agentic AI -- A Knowledge Graph is All You Need

يُعد AutoClimDS نظام ذكاء اصطناعي وكيلًا يستفيد من رسم بياني معرفي مناخي منسق كركيزة هيكلية أساسية له لأتمتة تحليل بيانات المناخ من البداية إلى النهاية وإعادة إنتاج الأشكال العلمية من اللغة الطبيعية، متجاوزًا بذلك قيود النماذج اللغوية الكبيرة عامة الأغراض في تحديد مجموعات البيانات الموثوقة وبناء سير عمل علمي سليم.

Ahmed Jaber, Wangshu Zhu, Ayon Roy, Karthick Jayavelu, Justin Downes, Sameer Mohamed, Candace Agonafir, Linnia Hawkins (…)2026-03-16
💬 NLP

A Decision-Theoretic Formalisation of Steganography With Applications to LLM Monitoring

تقترح هذه الورقة إطاراً نظرياً لاتخاذ القرار للكشف عن الإخفاء الرقمي (steganography) وقياسه في النماذج اللغوية الكبيرة من خلال تقديم مفهوم "معلومات V\mathcal{V} المعممة" و"الفجوة الإخفائية" لقياس عدم تماثل المعلومات بين الوكلاء، مما يتغلب على قيود الطرق الكلاسيكية التي تتطلب توزيعات مرجعية معروفة.

Usman Anwar, Julianna Piskorz, David D. Baek, David Africa, Jim Weatherall, Max Tegmark, Christian Schroeder de Witt, Mi (…)2026-03-16
💻 computer science

VQQA: An Agentic Approach for Video Evaluation and Quality Improvement

تُعد VQQA إطار عمل موحداً متعدد الوكلاء يعمل على تعزيز جودة توليد الفيديو من خلال الاستفيد من الأسئلة المرئية المولدة ديناميكياً وانتقادات النماذج اللغوية البصرية (VLM) كمتدرجات دلالية لتمكين التحسين الفعال للمطالبات في الأنظمة ذات الصندوق الأسود دون الحاجة إلى الوصول إلى نماذج الصندوق الأبيض.

Yiwen Song, Tomas Pfister, Yale Song2026-03-16
🤖 AI

LLM Constitutional Multi-Agent Governance

تقدم هذه الورقة "الحوكمة الدستورية متعددة الوكلاء" (CMAG)، وهي إطار عمل يستخدم القيود الصارمة وتحسين المنفعة المرنة لضمان بقاء التعاون الذي تتوسطه النماذج اللغوية الكبيرة في الأنظمة متعددة الوكلاء مستقراً من الناحية الأخلاقية، وذلك عبر الموازنة بين النتائج الداعمة للمجتمع والحفاظ على استقلالية الوكيل، والنزاهة المعرفية، والعدالة.

J. de Curtò, I. de ZarzÃ2026-03-16
💻 computer science

A Generative Model of Conspicuous Consumption and Status Signaling

تقترح هذه الورقة وتتحقق من صحة نظرية حوسبية تُظهر أن الرموز المرموقة والاستهلاك التفاخري ينبثقان داخلياً من خلال الملاحظة الاجتماعية وإكمال الأنماط التنبؤي في محاكاة الوكلاء القائمة على النماذج اللغوية الكبيرة، مما يجسّر بفعالية الفجوة بين الإدراك على المستوى الجزئي والظواهر الاقتصادية على المستوى الكلي مثل تأثيرات فيبلن وتشكّل الثقافات الفرعية.

Logan Cross, Jordi Grau-Moya, William A. Cunningham, Alexander Sasha Vezhnevets, Joel Z. Leibo2026-03-16
🤖 AI

WideSeek-R1: Exploring Width Scaling for Broad Information Seeking via Multi-Agent Reinforcement Learning

تقدم هذه الورقة WideSeek-R1، وهو إطار عمل للتعلم التعزيزي متعدد الوكلاء يوظف بنية "الوكيل القائد-الوكيل التابع" لتحقيق أداء واسع في البحث عن المعلومات يضاهي النماذج الضخمة ذات الوكيل الواحد من خلال الاستفادة من توسيع العرض والتنفيذ المتوازي.

Zelai Xu, Zhexuan Xu, Ruize Zhang, Chunyang Zhu, Shi Yu, Weilin Liu, Quanlu Zhang, Wenbo Ding, Chao Yu, Yu Wang2026-03-13
🤖 machine learning

Can AI Agents Agree?

تُظهر هذه الورقة أن وكلاء النماذج اللغوية الكبيرة الحاليين يعانون من أجل تحقيق إجماع موثوق في البيئات العدائية، حيث يتدهور الأداء مع زيادة حجم المجموعة ومعدلات الخطأ البيزنطي، ويرجع ذلك أساساً إلى إخفاقات الحيوية مثل حالات انتهاء المهلة الزمنية بدلاً من فساد القيم.

Frédéric Berdoz, Leonardo Rugli, Roger Wattenhofer2026-03-13
💻 computer science

EducaSim: Interactive Simulacra for CS1 Instructional Practice

تقدم هذه الورقة EducaSim، وهو إطار عمل توليدي قائم على الوكلاء يتيح ممارسة تعليمية قائمة على لعب الأدوار وقابلة للتوسع للمعلمين المبتدئين في مساقات علوم الحاسب (CS1) عبر الإنترنت الضخمة، وذلك من خلال محاكاة شخصيات طلاب متنوعة ومواد دراسية دون الأعباء اللوجستية للميسرين البشريين.

Cameron Mohne, Nicholas Vo, Dora Demszky, Chris Piech2026-03-13
🤖 machine learning

Grammar of the Wave: Towards Explainable Multivariate Time Series Event Detection via Neuro-Symbolic VLM Agents

تقدم هذه الورقة إطار عمل لوكيل نموذج لغوي بصري (VLM) عصبي-رمزي يسمى "Knowledge-Guided TSED"، والذي يستخدم تمثيل "شجرة منطق الأحداث" (Event Logic Tree) المبتكر للربط بين أوصاف الأحداث باللغة الطبيعية وبيانات السلاسل الزمنية متعددة المتغيرات، مما يتيح كشفاً دقيقاً للأحداث في وضع الصفر (zero-shot) وتبريراً قابلاً للتفسير مع الحد من الهلوسة في المجالات عالية المخاطر.

Sky Chenwei Wan, Tianjun Hou, Yifei Wang, Xiqing Chang, Aymeric Jan2026-03-13