💻 computer science

Agent Safety Should Be a Runtime Contract

تجادل هذه الورقة بأن سلامة الذكاء الاصطناعي للوكلاء المستقلين يجب أن تتحول من كونها خاصية وقت التدريب إلى عقد وقت التشغيل الذي يتم فرضه عبر حزام أمان، يجمع بين الضوابط الوقائية والتحقق الدليلي لضمان أن تكون الأفعال محظورة قبل حدوث الضرر ومثبتة بعد التنفيذ.

Albus W. Ng, Yi Han, Jusheng Zhang, Wenhao Wang2026-08-13
🤖 machine learning

Federated Learning for Distributed CNC Tool Wear Prediction

تُثبت هذه الورقة أن التعلم الاتحادي يُمكّن بفعالية من التنبؤ التعاوني بتآكل أدوات التحكم الرقمي بالحاسوب (CNC) عبر بيئات التصنيع الموزعة، محققاً أداءً مقارباً للنماذج المركزية مع الحفاظ على خصوصية البيانات.

Afsana Khan, Morris Stallmann, Marcin Pietrasik, Charis Kouzinopoulos, Anna Wilbik2026-08-13
🔬 materials science

Chemically Meaningful Textualization Enables Explainable Validation of Metal-Organic Frameworks by Large Language Models

تُثبت هذه الورقة أن تحويل البيانات البلورية إلى نص ذي معنى كيميائي يُمكّن النماذج اللغوية الكبيرة الضبطت بدقة من العمل كأدوات تحقق دقيقة وقابلة للتفسير للأطر المعدنية العضوية، مما يسمح بتحديد الأخطاء الهيكلية وتقديم مبررات تشخيصية تضاهي النماذج المتخصصة القائمة على الرسوم البيانية.

Guobin Zhao, Xiao-Yan Li2026-08-13
💻 computer science

Backdoor Decontamination Dynamics in LLM Agents

تقدم هذه الورقة إطار عمل لتحليل تطهير الباب الخلفي في وكلاء النماذج اللغوية الكبيرة، حيث تُثبت أن استراتيجية التسميم الدفاعي المتبوعة بإلغاء التعلم تقضي بفعالية على الأبواب الخلفية المجهولة الأصلية —حتى في النماذج المصابة بشكل مشترك— من خلال فصل التعرف على المحفز عن التنفيذ الخبيث، رغم احتمال بقاء آثار من الوعي بالمحفز الأصلي في طبقات النموذج المتوسطة.

Gabriel Huang, Abhay Puri, Léo Boisvert, Alexandre Drouin, Perouz Taslakian, Spandana Gella, Christopher Pal2026-08-13
💻 computer science

Self-evolving network verifiers

تقترح هذه الورقة البحثية "أدوات التحقق من الشبكات ذاتية التطور"، وهو نظام يتعلم ويصقل نماذج الشبكات الرمزية بشكل مستقل عبر المقارنة المتكررة بين مقترحات وكيل البرمجة وسلوك أجهزة التوجيه الحقيقي، مما يلغي الحاجة إلى الصيانة اليدوية للنماذج المعرضة للخطأ ويمكّن من التحقق من ميزات الشبكة المعقدة والخاصة بموردين محددين.

Ioannis Protogeros, Tibor Schneider, Laurent Vanbever2026-08-13
🤖 AI

Can Frontier LLMs Match Natively Multimodal Embeddings? A Comparison on Hard-Negative Text-to-Image Retrieval

تُظهر هذه الدراسة أن النماذج اللغوية الكبيرة الرائدة مثل GPT-4.1 وClaude Sonnet 4.6 تحقق أداء استرجاع يضاهي نموذج Gemini Embedding 2 متعدد الوسائط الأصلي من Google على مجموعة بيانات Flickr30k، رغم أن الأخير يظل متفوقاً في التطبيقات ذات زمن الاستجابة المنخفض بفضل التضمينات القابلة للحساب المسبق.

Archan Dutta, Vyanktesh Kanungo2026-08-13
💰 quantitative finance

Governing Agentic AI in FinTech

تجادل هذه الورقة بأن القيد الحوكمي الأساسي للذكاء الاصطناعي الوكيل في التكنولوجيا المالية ليس القدرة، بل قابلية التحقق، مقدمةً مفهوم "فجوة قابلية التحقق" ومثبتةً من خلال دراسات تجريبية أن الأنظمة الحالية تفتقر إلى قابلية التكرار والقدرة على التفسير المطلوبة للتفويض الدفاعي للقرارات المالية ذات العواقب الجسيمة.

Henry Han2026-08-13
🤖 machine learning

Dynamics Models for Offline Hyperparameter Selection in Real-World RL

تقدم هذه الورقة أول تطبيق واقعي لنماذج المعايرة غير المتصلة (offline calibration models) لاختيار المعلمات الفائقة في التعلم التعزيزي، مما يثبت فعاليتها في محطة بلدية لمعالجة المياه من خلال توليد مسارات طويلة الأمد وواقعية واستعادة اتجاهات حساسية ذات معنى في بيانات مستشعرات عالية الأبعاد وغير مستقرة.

Jordan Coblin, Han Wang, Martha White, Adam White2026-08-13
🤖 AI

Inverse Theory of Mind Modeling for Content Recommendation: From Web Browsing to Dynamic Intelligent Interfaces

تقترح هذه الورقة مساراً لنظرية العقل العكسية (IToM) يستخدم الاستدلال الاستنتاجي والاستدلال التراجعي المدفوع بالنماذج اللغوية الكبيرة لإعادة بناء معتقدات المستخدم وتوليد شخصيات مهيكلة من تفاعلات التصفح، مما يثبت دقة فائقة في التنبؤ بسمات المستخدم وتمكين توصيات محتوى ديناميكية وغير مرتبطة بنمط وسائط محدد عبر تطبيقات مثل VisionOS.

Mengyu Chen, Feiyu Lu, Chun-Fu Chen, Lucas Vinh Tran, Jay Katukuri2026-08-13
🤖 AI

From Numbers to Judgment: Specialist LLM Agents and Reinforcement Learning for European Listed Real Estate

تُثبت هذه الورقة أنه في حين أن تفكيك تحليل العقارات الأوروبية المدرجة إلى وكلاء نماذج لغوية كبيرة متخصصين يحسن بشكل كبير من أداء المهام الرقمية، فإن تعزيز الحكم المالي التكاملي يتطلب تكييفاً مستهدفاً للمعلمات عبر التعلم المعزز (GRPO) بدلاً من الاكتفاء بالتفكيك على مستوى الأوامر النصية وحدها.

Pardis Taghavi, Santosh Bhavani2026-08-13