🤖 machine learning

Strategy, Not Payoffs: A Behavioural Embedding of Normal-Form Games

تقترح هذه الورقة نموذج تضمين سلوكي خفيف الوزن يعتمد على إنتروبيا توازن ناش وحساسية الاستجابة للتنبؤ بنجاح بكيفية نقل الضبط الدقيق على ألعاب ذات صيغة عادية محددة للقدرات الاستراتيجية إلى ألعاب غير مرئية في النماذج اللغوية الكبيرة، متفوقة بذلك على التضمينات الهيكلية الحالية التي تكتفي بمجرد حفظ هويات الألعاب.

Joshua Caiata, Sreepriya Pulyassary, Xiang Li, Kate Larson2026-07-31
💻 computer science

Evaluating Agentic Bioinformatics through Function, Evidence, and Validation

تقدم هذه الورقة إطار عمل "الوظيفة-الدليل-التحقق" (FEV) لنقل تقييم الأنظمة المعلوماتية الحيوية الوكيلية من دقة المخرجات النهائية إلى المصداقية العلمية وقابلية التدقيق لمسارات سير العمل بأكملها، مما يكشف أن القدرات الحالية في التخطيط والتنفيذ تتجاوز تلك الموجودة في إثبات المصدر والتحقق والاختبار التجريبي.

Phuc Pham, Truong-Son Hy2026-07-31
💻 computer science

Stop Shipping AI Agents on Faith: Capability Is Not Production Readiness

تقدم هذه الورقة "مؤشر وكيل الإثبات" (PAI)، وهو إطار عمل للجاهزية الحوكمية ينقل قرارات نشر وكلاء الذكاء الاصطناعي من الاعتماد على استعراض القدرات إلى تقييم قابل للتدقيق رباعي الأبعاد يشمل التقييم، والسياق، والامتثال، والحوكمة، والذي تم التحقق من صحته في المجالات المنظمة للتمييز بين الجاهزية للإنتاج ومجرد القدرة الوظيفية.

Fouad Bousetouane2026-07-31
💻 computer science

Argonaut: Interactive Visual Exploration for Distributed Optimization

تقدم الورقة البحثية "Argonaut"، وهو لوحة تحكم خفيفة الوزن ومحواة داخل حاويات (containerized)، تتيح استكشافاً بصرياً وتفاعلياً لعملية البحث بأكملها لعمليات تحسين الاختيار المنفصل متعددة الوكلاء في البيئات اللامركزية، مما يحول عملية حسابية كانت تقليدياً "صندوقاً أسود" إلى نظام يشرك العنصر البشري في الحلقة، قادراً على التعامل مع آلاف الوكلاء وملايين الحلول.

Srijoni Majumdar, Chuhao Qin, Evangelos Pournaras2026-07-31
💻 computer science

AgentRadio: Passive Awareness for Long-Horizon Multi-Agent Collaboration

يقدم AgentRadio طبقة تمرير رسائل غير متزامنة تتيح فهمًا برمجيًا متعدد الوكلاء طويل الأمد من خلال السماح للوكلاء بالحفاظ على وعي سلبي باكتشافات زملائهم أثناء التنفيذ، مما يحقق معدل نجاح قدره 62.1% في معيار SWE-Atlas QnA — متفوقًا بشكل كبير على كل من النماذج المرجعية أحادية الوكيل والنماذج الأحدث من خلال التنسيق المستمر أثناء المسار.

Xinxing Ren, Qianbo Zang, Ziyan Wang, Caelum Forder, Suman Deb, Peter Carroll, Zekun Guo2026-07-31
🧬 biology

Using Theory of Mind to Arbitrate between Social and Non-social Learning

تقترح هذه الورقة وتتحقق من صحة نموذج "التعقل العقلاني"، الذي يوضح أن البشر يستخدمون "نظرية العقل" للتحكيم عقلانياً بين التعلم الاجتماعي وغير الاجتماعي من خلال تقدير منفعة مراقبة الآخرين مقابل الاستكشاف المباشر.

Lance Ying, Ryan Truong, Joshua B. Tenenbaum, Samuel J. Gershman2026-07-31
🤖 AI

When Should AI Follow? Task Structure and Joint Adaptation by Human and AI Agents

تقدم هذه الورقة نموذجاً حوسبياً يوضح أن التعاون الأمثل بين الإنسان والذكاء الاصطناعي يعتمد على بنية المهام وأنظمة الذاكرة، كاشفةً أن الأداء لا يتم تعظيمه عبر نهج "الذكاء الاصطناوي أولاً" العالمي، بل من خلال تسلسل الوكلاء استراتيجياً — وتحديداً بجعل الذكاء الاصطناعي عديم القياس (scale-free) يتبع البشر ذوي الأداء العالي أو باستخدام البحث العشوائي لإنقاذ المسارات التي بدأها بشر ذوو أداء ضعيف.

Prothit Sen, Sai Mihir Jakkaraju2026-07-30
🤖 AI

Pramana: A Composable, Domain-Specific Backend for Empirical Networking Research

يقدم هذا البحث "برامانا" (Pramana)، وهو خلفية برمجية قابلة للتركيب ومتخصصة في مجال معين، تعمل على سد الفجوة بين التفكير البحثي وتوليد البيانات في مجال الشبكات التجريبية من خلال استخدام مواصفات نية موحدة لتفكيك التجارب إلى محاور مستقلة تشمل النية، والبنية التحتية، والآلية، مما يتيح تشغيل تعريف تجربة واحدة عبر بيئات تنفيذ متنوعة ويتفوق بشكل كبير على الأدوات الحالية في تلبية المتطلبات البحثية الواقعية.

Jaber Daneshamooz, Eugene Vuong, Alagappan Ramanathan, Manni Moghimi, Haarika Manda, Satyam Kumar, Snithik Thode, Satyan (…)2026-07-30
🤖 machine learning

DREvo: Distilling Recalibrated Historical Experience for Harness Self-Evolution

تُعد DREvo طريقة مبتكرة للتطور الذاتي الموجه تعالج عدم استقرار النهج الحالية من خلال إعادة معايرة الخبرة التاريخية ديناميكيًا وتقطير اتجاهات بحث قابلة للتنفيذ، مما يحقق أداءً فائقًا ومسارات تطور أكثر سلاسة عبر معايير الاستدلال والوكالة ضمن ميزانيات محدودة.

Hanghui Guo, Weijie Shi, Zhangze Chen, Shengxiang Xu, Yishu Wang, Yimei Zhang, Wangze Ni, Jia Zhu, Shimin Di2026-07-30
🤖 AI

Partner Capability Estimation for Task-Agnostic Adaptation in Ad-Hoc Teamwork

تقدم هذه الورقة البحثية نموذج CE-CM وامتداده القائم على التنوع CE-CM-Div، وهو إطار عمل بايزي تقريبي يمكّن الوكلاء المستقلين من تقدير قدرات الشريك الخفية والثابتة للمهمة بسرعة وتكييف تخطيطهم المشترك في سيناريوهات العمل الجماعي المرتجل دون الحاجة إلى تدريب مسبق أو معرفة سابقة بالمهمة.

Peter Tisnikar, Maja Swieczkowska, Benteng Ma, Gerard Canal, Matteo Leonetti2026-07-30