🤖 AI

MoralityGym: A Benchmark for Evaluating Hierarchical Moral Alignment in Sequential Decision-Making Agents

تقدم الورقة البحثية MoralityGym، وهو معيار مرجعي يضم 98 معضلة أخلاقية هرمية وصيغة جديدة تسمى "سلاسل الأخلاق" (Morality Chains)، لتقييم وتحسين المحاذاة الأخلاقية لوكلاء اتخاذ القرار المتسلسل من خلال دمج رؤى من علم النفس والفلسفة.

Simon Rosen, Siddarth Singh, Ebenezer Gelo, Helen Sarah Robertson, Ibrahim Suder, Victoria Williams, Benjamin Rosman, Ge (…)2026-05-22
🤖 AI

PenTiDef: Decentralized Federated Intrusion Detection System with Differential Privacy and Latent-Space Defense via Blockchain Coordination in IIoT

يُعدّ "بنتي ديف" (PenTiDef) إطار عمل لامركزي بالكامل، يحافظ على الخصوصية، ومقاوم للتسمم، للكشف عن التسلل في إنترنت الأشياء الصناعي، حيث يدمج بشكل تآزري بين الخصوصية التفاضلية الموزعة، وآلية دفاع خفيفة الوزن في الفضاء الكامن، وسلسلة كتل (blockchain) مرخصة لتحقيق تعلم تعاوني قوي وآمن وقابل للتوسع دون الحاجة إلى خادم مركزي.

Phan The Duy, Nghi Hoang Khoa, Nguyen Tran Anh Quan, Luong Ha Tien, Ngo Duc Hoang Son, Van-Hau Pham2026-05-22
💻 computer science

The Attribution Impossibility: No Feature Ranking Is Faithful, Stable, and Complete Under Collinearity

تثبت هذه الورقة أنه لا يمكن لأي طريقة لترتيب الميزات أن تحقق الأمانة والاستقرار والكمال في آن واحد في ظل وجود التلازم بين الميزات، حيث تصف حيز التصميم الناتج كفصل حاد بين الطرق الأمينة غير المستقرة والأساليب التجميعية مثل DASH، مع التحقق ميكانيكيًا من جميع النتائج في لغة Lean 4.

Drake Caraker, Bryan Arnold, David Rhoads2026-05-22
💻 computer science

Don't Collapse Your Features: Why CenterLoss Hurts OOD Detection and Multi-Scale Mahalanobis Wins

تقدم هذه الورقة GOEN، وهو مسار معالجة بسيط وفعال للكشف عن البيانات خارج التوزيع (OOD) يتفوق على النماذج المرجعية المتطورة من خلال الاستفادة من الميزات متعددة المقاييس ومسافة ماهالانوبيس، بينما يوضح أن "CenterLoss"، رغم تحسينه لدقة التصنيف، يؤدي إلى تدهور كبير في الكشف عن البيانات خارج التوزيع عبر تشويه الهندسة الميزية المطلوبة لتقدير اليقين المعرفي الموثوق.

Rahul D Ray2026-05-22
💻 computer science

HealthCraft: A Reinforcement Learning Safety Environment for Emergency Medicine

تُعد HealthCraft بيئة تعزيز تعلم عامة ومبتكرة صُممت لتقييم النماذج اللغوية الرائدة في طب الطوارئ عبر محاكاة سير عمل سريري واقعي مع معايير سلامة صارمة ذات طبقتين، مما كشف عن معاناة النماذج الحالية من انهيار شبه كامل في الأداء في المهام متعددة الخطوات، وسلط الضوء على الأهمية البالغة لدقة البنية التحتية في تقييمات السلامة.

Brandon Dent2026-05-22
💻 computer science

Autonomous LLM Agents & CTFs: A Second Look

تعيد هذه الورقة تقييم قدرات وكلاء النماذج اللغوية الكبيرة في مجال الأمن الهجومي من خلال إثبات أنه بينما تضاهي الوكلاء ذوو الأغراض العامة مثل Claude Code أداء البنيات المعقدة والمصممة هندسياً في تحديات "التقط العلم والعلم" (CTF)، لا يزال كلاهما يواجه عوائق كبيرة على المستوى البشري، مع إثبات أن التنسيق الهيكلي متعدد الأدوار يتفوق على التصميمات المتجانسة من حيث الاتساق وكفاءة التكلفة.

Youness Bouchari, Matteo Boffa, Marco Mellia, Idilio Drago, Thanh Minh Bui, Dario Rossi2026-05-22
🧬 biology

Graph neural network explanations reveal a topological signature of disease-associated hubs in biological networks

تقيم هذه الورقة أربع طرق لتفسير الشبكات العصبية الرسومية على بيانات سرطان الثدي للكشف عن بصمات طوبولوجية متميزة لمراكز المرض، وتقترح إطار عمل توافقياً يدمج هذه النهج المتكاملة لتحسين ترتيب أولويات جينات السرطان النموذجية واستعادة مسارات الإشارات المتماسكة بيولوجياً بشكل كبير.

Kyle Higgins, Ivan Laponogov, Dennis Veselkov, Kirill Veselkov2026-05-22
💻 computer science

Predicting Performance of Symbolic and Prompt Programs with Examples

تقترح هذه الورقة إطار عمل RAP، وهو إطار للتنبؤ بالأداء يستفيد من المهام المماثلة المسترجعة وبرامج التلقين (prompt programs) لبناء توزيع احتمالي مسبق تقريبي، مما يعالج بفعالية عدم موثوقية التلقين باستخدام النماذج اللغوية الكبيرة عبر التمييز بين توزيع أدائها المنتشر وطبيعة البرامج الرمزية القائمة على مبدأ "الكل أو لا شيء".

Chengqi Zheng, Keya Hu, Shuzhi Liu, Tao Wu, Kevin Ellis, Yewen Pu2026-05-22
💻 computer science

Harnesses for Inference-Time Alignment over Execution Trajectories

تقدم هذه الورقة إطار عمل لمحاذاة المسار أثناء الاستدلال لتحليل هندسة الحصر لوكلاء النماذج اللغوية الكبيرة، كاشفةً أن الأداء الأمثل يتطلب غالباً سير عمل جزئياً بدلاً من كونه مهيكلاً بالكامل عبر الموازنة بين تفكيك المهام والتنفيذ الموجّه لتجنب أنماط الفشل مثل الإفراط في التفكيك والهلوسة.

Boyuan Wang, Bochao Li, Minghan Wang, Yuxin Tao, Fang Kong2026-05-22
🧬 biology

Protein Thoughts: Interpretable Reasoning with Tree of Thoughts and Embedding-Space Flow Matching for Protein-Protein Interaction Discovery

تقدم الورقة البحثية **Protein Thoughts**، وهو إطار عمل تفسيري لاكتشاف التفاعلات بين البروتينات يجمع بين دالة قيمة شفافة تفكك أدلة الارتباط إلى أربع إشارات بيولوجية وبين بحث "شجرة الأفكار" الموجه بالفرضيات ومطابقة التدفق في فضاء التضمين لتحقيق دقة تنبؤ رائدة مع توفير تبرير ميكانيكي لتصنيفاتها.

Kingsley Yeon, Xuefeng Liu, Promit Ghosal2026-05-22