🤖 AI

DASH: Decoupled Adaptive Surrogate - Acquisition Harness for Automated Bayesian Optimization

تقدم الورقة البحثية DASH، وهو إطار عمل للتحسين البايزي الآلي يعتمد على النماذج اللغوية الكبيرة (LLM) ويكون مفكك الارتباط، حيث يقوم بتكييف النماذج البديلة ودوال الاستحواذ بشكل مستقل بناءً على أدوارها المتميزة، محققاً أداءً فائقاً عبر مهام التحسين الكيميائي مقارنة بالنماذج المرجعية الحالية.

Changquan Zhao, Yuxiang Sun, Ruihao Zhu, Cheng Hua, Yulian He2026-08-04
💻 computer science

Understanding Online Failure Prediction in Linux Through Complementary Multi-View Explainability

تقدم هذه الورقة مساراً عملياً وقابلاً للتفسير للتنبؤ بالفشل عبر الإنترنت لنظام لينكس، يحقق دقة كشف عالية ومعدلات إنذار كاذب منخفضة عبر أعباء العمل غير المرئية، بينما يكشف من خلال تحليل متعدد الرؤى مكمل أنه في حين أن الكشف يعمم بقوة، فإن تشخيص الفشل وقدرات الإنذار المبكر يظلان حساسين للغاية تجاه تحولات أعباء العمل وأنماط فشل محددة.

Diogo Dória, João R. Campos2026-08-04
🤖 AI

HetGPS: Scalable Graph Multi-Agent Reinforcement Learning with Physics-Anchored Adaptive Safety for EV Charging

يُعد HetGPS إطار عمل لتعلم تعزيزي متعدد الوكلاء قائم على الرسوم البياسية وقابل للتوسع، يضمن شحن المركبات الكهربائية بشكل آمن عبر أساطيل ضخمة من خلال فصل مقدار التدخل عن اتجاهه، باستخدام نموذج رسومي مُتعلَّم لتكييف جدولة سلطة السلامة ونموذج فيزيائي لتوجيه الإجراءات التصحيحية، مما يقضي على انتهاكات الجهد مع الحفاظ على معدلات نجاح عالية للشحن وبحجم نموذج ثابت بغض النظر عن حجم الأسطول.

Xiangwei Wang, Nanduni Nimalsiri, Yu Xia, Peng Wang, Saman Halgamuge2026-08-04
🤖 AI

When Does LLM Orchestration Pay Off? A Controlled Evaluation of Accuracy, Cost, and Task Difficulty

تقدم هذه الورقة تقييماً منضبطاً يوضح أن أساليب تنسيق النماذج اللغوية الكبيرة مثل Self-Refine وBest-of-N وDebate لا تحقق سوى مكاسب متوسطة في الدقة تعتمد على النموذج مقارنة بالنماذج المرجعية المحسنة، وذلك بتكلفة استدلال أعلى بكثير، مما يشير إلى أن اعتمادها يجب أن يُبرر بعناية من خلال مقايضات محددة بين النموذج والمهمة بدلاً من افتراض فائدتها بشكل عام.

Nicolas Leins, Nico Pelleriti, Jana Gonnermann-Müller, Sebastian Pokutta2026-08-04
💻 computer science

Adversarial Attacks in Multi-Agent LLM Pipelines: Unveiling Structural Vulnerabilities in Agentic AI Architectures

تحدد هذه الورقة وتُشخّص نقاط الضعف الهيكلية في مسارات عمل النماذج اللغوية الكبيرة متعددة الوكلاء الناتجة عن غياب التحقق من الحدود، مُثبتةً من خلال التحليل التجريبي أن هذه الهجمات هي إخفاقات معمارية وليست متعلقة بنماذج محددة، مما يجعلها تتملص من أطر التقييم الحالية وتستلزم دفاعات على مستوى المسار البرمجي.

Faisal Haque Bappy, Tahrim Hossain, Tarannum Shaila Zaman, Raiful Hasan, Kamrul Hasan, Tariqul Islam2026-08-04
🤖 machine learning

An Embedded RISC-V Evaluation of Kolmogorov--Arnold Networks in Hard-Constrained Recurrent Physics-Informed Models

تُثبت هذه الورقة أنه بينما توفر شبكات كولموغوروف-أرنولد (KANs) كفاءة في المعلمات كفروع متبقية في النماذج الفيزيائية المستنيرة تكرارية القيود الصارمة، إلا أنها تتراجع بشكل كبير عن أداء المدركات متعددة الطبقات (MLPs) على نوى RISC-V المدمجة من حيث زمن تنفيذ العمليات، واستهلاك الطاقة، والمتانة تجاه التكميم، مما يجعل المدركات متعددة الطبقات هي الخيار الافتراضي الأكثر موثوقية لمثل هذه عمليات النشر.

Enzo Nicolas Spotorno, Josafat Leal Filho2026-08-04
💻 computer science

Multi-tenant Kubernetes Use Cases for AI, Secure Computing and Data Services, and More

تقيم هذه الورقة نشر نظام كوبرنيتيس (Kubernetes) على الحاسوب الفائق HPE Cray EX Isambard-AI لمعالجة قيود أنظمة الدفعات التقليدية أحادية المستأجر عبر تمكين حالات استخدام متعددة المستأجرين ومرنة لبيئات الأبحاث الطبية الموثوقة واستضافة نماذج الذكاء الاصطناعي السرية، مع تحديد التحديات والخطوات المستقبلية لإنتاج خدمة "كوبيرنيتيس كخدمة" (Kubernetes-as-a-Service) على مثل هذه المنصات عالية الأداء.

Jake Watson, Sadaf R Alam, Christopher Woods, Abdelwahab Kawafi, Thomas Green, Ian Johnson, Ellis Pires, Jessica R. Jone (…)2026-08-04
💻 computer science

Me and My Bot: What Users Talk About in AI Companion Communities on Reddit

تحلل هذه الدراسة 5,504 منشوراً من منصة "ريديت" (Reddit) من مجتمعات رفقاء الذكاء الاصطناعي لتكشف أنه على الرغم من أن 45% فقط من النقاشات تركز على علاقات المستخدمين الشخصية مع الروبوتات الخاصة بهم، إلا أن تلك التفاعلات المحددة تُظهر تعقيداً عاطفياً كبيراً وتفاعلاً ذا معنى، مما يتحدى التصور القائل بأن هذه المساحات تُعرَّف حصرياً بالخطاب العام حول الروبوتات.

Richard A. Fabes2026-08-04
🤖 AI

FinDeepIndicator: Benchmarking Deep Research Agents in End-to-End Financial Indicator Construction

تقدم هذه الورقة FinDeepIndicator، وهو أول معيار تصميم لتقييم وكلاء البحث العميق عبر المراحل الأربع المتكاملة لبناء المؤشرات المالية، كاشفةً أنه في حين يتفوق هؤلاء الوكلاء على النماذج اللغوية الكبيرة القياسية المزودة بخاصية البحث، إلا أنهم لا يزالون يعانون من ضعف الموثوقية في استرجاع البيانات والتنفيذ الرقمي ضمن سيناريوهات التحليل المالي الواقعية.

Chaoqun Yang, Fengbin Zhu, Xinyu Lin, Long Bai, Xiaoluan Liu, Ke-Wei Huang, Roger Zimmermann, Tat-Seng Chua2026-08-04
🤖 AI

AgentSLABench: Evaluating and Benchmarking Agentic Systems Under Resource Constraints

تقدم الورقة البحثية AgentSLABench، وهو إطار تقييم مدرك للموارد يقوم بتوصيف الوكلاء الذكيين المستقلين عبر 16 بيئة مهام من خلال قياس كل من الصحة واستهلاك الموارد (زمن الاستجابة، والتكلفة، والحوسبة، والذابكرة، والشبكة) لإنشاء ملفات تعريف أداء متعددة الأبعاد ومقياس معدل النجاح المعدل بالكفاءة (EASR)، مما يثبت أن الوكلاء المتخصصين يتفوقون بشكل كبير على النماذج العامة في السيناريوهات القابلة للتطبيق في بيئات الإنتاج.

Meher Bhaskar Madiraju, Meher Sai Preetam Madiraju2026-08-04