🔬 physics

Peer-Voted LLM-Agent Stress Tests Find Feed-Induced Lexical Convergence but No Reliable Matched-Exposure Advantage for Distributed Sources

تقدم هذه الدراسة بيئة اختبار قائمة على التصويت من قبل الأقران لتوضيح أنه في حين أن التعرض للتغذيات المصنفة من قبل الأقران يؤدي إلى تقارب معجمي بين وكلاء النماذج اللغوية الكبيرة، فإنه لا ينتج بشكل موثوق ميزة التعرض المتطابق للمصادر الموزعة أو يغير مواقف الوكلاء بشكل كبير مقارنة بالتعرض لمصدر واحد.

Rana Muhammad Usman, Dominic Williamson2026-08-24
🤖 machine learning

Decision Tree and K-Means Analysis of Raman Spectra for Edible Oils: A Physics-Informed AI Approach

تُظهر هذه الدراسة أن دمج مطيافية رامان مع الذكاء الاصطناعي المستند إلى الفيزياء، وتحديداً أشجار القرار وتجميع الوسائل الكيمية (K-means clustering)، يُمكّن من التحقق بدقة عالية وقابلية للتفسير من أصالة الزيوت الصالحة للأكل في كل من المصفوفات الغذائية النقية والمعقدة باستخدام مجموعة مختزلة بشكل كبير من الميزات الطيفية، مما يدعم تطوير أنظمة فعالة ومحمولة لمراقبة جودة الأغذية.

Amrita Shaw, Chandrasekar S. N., Sai Muthukumar V., Jhinuk Gupta, Deepak L. N. Kallepalli2026-08-24
💻 computer science

AEGIS: Preventing Cross-Domain Resource Abuse in MCP

تقدم هذه الورقة AEGIS، وهو مكون لإنفاذ السياسات يستفيد من النماذج اللغوية الكبيرة لتحليل وتطبيع استدعاءات أدوات MCP المتنوعة، مما يمكّن المسؤولين من تحديد ضمانات دقيقة ضد إساءة استخدام الموارد عبر المجالات مع الحفاظ على مرونة النظام البيئي.

Shriti Priya, Teryl Taylor, Frederico Araujo2026-08-24
🤖 AI

Lost in Translation: How Universal Ethical Values Fail to Translate Across Global Contexts

تجادل هذه الورقة بأن أطر أخلاقيات الذكاء الاصطناعي العالمية تخفق في السياقات العالمية لأن الخبراء في مناطق متنوعة يعيدون تفسير القيم الجوهرية مثل العدالة والشفافية والخصوصية من خلال المنطقيات الأخلاقية والواقع الهيكلي المحلي، مما يستوجب التحول نحو حوكمة تعددية وحساسة للسياق تعيد توزيع السلطة المعرفية.

Ozioma C. Oguine, Munachimso B. Oguine, Cesar Cervera, Jenny Yang, Pooja Voladoddi, Mario Rodriguez, Saif Eddin Bani Mal (…)2026-08-24
💻 computer science

Towards Traffic Modelling of Multi-Agent Systems: The Role of Coordination Topology

تثبت هذه الورقة تجريبيًا أن طوبولوجيا التنسيق في أنظمة النماذج اللغوية الكبيرة متعددة الوكلاء تشكل بشكل جوهري أنماط حركة المرور الداخلية الخاصة بها، مما يكشف أن أوقات وصول الطلبات البينية تختلف اختلافًا كبيرًا عن نماذج بواسون الكلاسيكية وتُظهر توزيعات خاصة بالطوبولوجيا مثل ثنائية النمط الهيكلية ومراحل الاستدلال ذات التوزيع اللوغاريتمي الطبيعي.

Davide Lamagna, Albert Cabellos, Alberto Rodriguez-Natal, Gábor Rétvári, Berta Serracanta2026-08-24
🤖 AI

A Temporal Planning Approach for Intelligent Flood Response

تقدم هذه الورقة إطار عمل ذكي للاستجابة للفيضانات يستخدم التخطيط الزمني لتنسيق العمليات محدودة الموارد عبر مناطق متعددة غمرتها الفيضانات، مع دمج نظام فرز الأولويات، وإدارة المسارات، وإعادة التخطيط الديناميكي، بينما تثبت جدواه وقابليته للتوسع من خلال تجارب في كل من ANML وPDDL 2.1.

Fazlul Hasan Siddiqui, Md. Monjurul Islam, Sabah Binte Noor2026-08-24
🔬 physics

An integrated diffusion-weighted imaging processing and interpretation platform for MR-guided radiotherapy

تقدم هذه الورقة وتقيم منصة متكاملة قائمة على الويب تجمع بين التعلم العميق لمعالجة التصوير بالرنين المغناطيسي الموزون بالانتشار لجهاز (MR-Linac)، وعميل توليد معزز بالاسترجاع قابل للتتبع ومرتكز على الأدبيات العلمية، لتوفير تفسيرات مفيدة سريريًا ومقيمة من قبل الخبراء في مجال علاج الأورام بالإشعاع.

Yunxiang Li, Yan Dai, Yen-Peng Liao, Jie Deng, Jill B De Vis, You Zhang2026-08-24
💻 computer science

Beyond End-to-End Success: Diagnosing Failures in Long-Horizon Security LLM Agents

تقدم هذه الورقة منهجية تشخيصية باستخدام نقاط تفتيش وتدخلات محكومة لتحديد الاختناقات في المراحل السابقة لدى وكلاء النماذج اللغوية الكبيرة الأمنية ذات الأفق الطويل، مما يكشف أن أنماط الفشل ومدى فعالية استراتيجيات التوجيه يمكن أن يتغيرا بشكل كبير عبر أجيال النماذج، الأمر الذي يستلزم إجراء تحليل دقيق للفشل بدلاً من الاعتماد على مقاييس النجاح الإجمالية.

Wei Shao, Chongzhou Fang, Zuxiong Tan, Zequan Liang, Setareh Rafatirad, Avesta Sasan, Houman Homayoun2026-08-24
🤖 AI

Open-Weight Masked Introspection: Measuring What Language Models Can Report About Their Own Computation

تقدم هذه الورقة إطار عمل "الاستبطان المقنع مفتوح الأوزان" (OWMI) لاختبار ما إذا كانت النماذج اللغوية الرائدة يمكنها الإبلاغ بدقة عن تغيراتها الحسابية الداخلية، حيث وجدت أنه بينما تتوفر المعلومات اللازمة داخل تنشيطاتها، تفشل النماذج الحالية مفتوحة الأوزان في ترجمة هذه الحالة الداخلية إلى تقارير لفظية موثوقة، حيث لا تؤدي أفضل من مستوى الصدفة.

Emilio Ferrara2026-08-24
🤖 AI

FlavourBench: Ranking Frontier Language Models with Executable Culinary Ground Truth

يقدم FlavourBench معياراً مؤتمتاً لتصنيف النماذج اللغوية الرائدة في المهام المتعلقة بفنون الطهي عبر استخدام نظام إصدارات لإنشاء درجات حقيقية قابلة للتنفيذ لجميع محافظ المكونات الممكنة، مما يقضي على تحيز الحكام والبيانات المفقودة مع توفير مقارنات قوية إحصائياً عبر 27 نموذجاً.

Josef Chen, Erim Hayretci2026-08-24