🤖 AI

Automated Reformulation of Robust Optimization via Memory-Augmented Large Language Models

تقدم هذه الورقة AutoRO-Bench، وهو معيار مخصص لتقييم النماذج اللغوية الكبيرة في إعادة صياغة التحسين المتين، وتقترح AutoREM، وهو إطار عمل معزز بالذاكرة وغير معتمد على الضبط، يتعلم ذاتياً من الإخفاقات السابقة لتحسين دقة وكفاءة إعادة الصياغة بشكل كبير عبر مختلف النماذج ومجموعات البيانات.

Jinbiao Chen, Shuang Jin, Guoyun Zhang, Junyu Zhang, Guanyi Wang, Hanzhang Qin2026-05-13
🤖 AI

MedMemoryBench: Benchmarking Agent Memory in Personalized Healthcare

يقدم MedMemoryBench إطار عمل مرجعي جديد واسع النطاق لوكلاء الرعاية الصحية الشخصيين، يستخدم مسار تعاوني بين الإنسان والوكيل لتوليد مسارات طبية واقعية وبروتوكول تقييم تدفقي لتقييم أداء الذاكرة بصرامة، مما يكشف عن اختناقات حرجة مثل تشبع الذاكرة في البنيات الحالية.

Yihao Wang, Haoran Xu, Renjie Gu, Yixuan Ye, Xinyi Chen, Xinyu Mu, Yuan Gao, Chunxiao Guo, Peng Wei, Jinjie Gu, Huan Li (…)2026-05-13
🤖 AI

Trade-offs in Decentralized Agentic AI Discovery Across the Compute Continuum

تقيم هذه الورقة المقايضات بين الشبكات المتراكبة المهيكلة من نوع Chord وPastry وKademlia لاكتشاف الوكلاء اللامركزي عبر متصل الحوسبة، مع تحليل أدائها من حيث الموثوقية، وسلوك بدء التشغيل، والعبء الإضافي لطبقة التحكم في ظل كل من ظروف الاستقرار وظروف التغيير العالي، وذلك لتحديد نقاط التشغيل المثلى لبيئات الحافة إلى السحابة.

Patrizio Dazzi, Emanuele Carlini, Matteo Mordacchini, Saul Urso2026-05-13
📊 statistics

Minimax Rates and Spectral Distillation for Tree Ensembles

تحدد هذه الورقة معدلات التقارب المثلى من نوع (minimax) لنموذج الغابة العشوائية في الانحدار عبر ربطها باضمحلال القيم الذاتية لمؤثرات النواة المستحثة، وتستفيد من هذا المنظور الطيفي لتطوير مخططات ضغط عالية الكفاءة تعمل على تقطير مجموعات الأشجار إلى نماذج مدمجة وعالية الأداء.

Binh Duc Vu, David S. Watson2026-05-13
🤖 machine learning

Martingale-Consistent Self-Supervised Learning

تقدم هذه الورقة إطاراً للتعلم الذاتي الإشراف المتمسك بخصائص المارتينجال (martingale-consistent)، والذي يفرض التماسك بين التنبؤات الخشنة والمُحسّنة في ظل الملاحظة الجزئية، مما يؤدي إلى تحسين متانة النموذج ومعايرته مقارنة بأهداف الثبات القياسية.

Moritz Gögl, Hanwen Xing, Christopher Yau2026-05-13
🤖 AI

Very Efficient Listwise Multimodal Reranking for Long Documents

تقدم الورقة البحثية ZipRerank، وهو إعادة ترتيب متعدد الوسائط قائم على القوائم عالي الكفاءة يحقق دقة رائدة في مجالها على المستندات الطويلة مع تقليل زمن انتقال الاستدلال بشكل كبير من خلال إلغاء فك التشفير التوليدي واستخدام استراتيجية تدريب ثنائية المراحل.

Yiqun Sun, Pengfei Wei, Lawrence B. Hsieh2026-05-13
🤖 AI

IPI-proxy: An Intercepting Proxy for Red-Teaming Web-Browsing AI Agents Against Indirect Prompt Injection

تقدم الورقة البحثية IPI-proxy، وهي مجموعة أدوات مفتوحة المصدر تستخدم وكيل اعتراض (intercepting proxy) لإعادة كتابة استجابات HTTP ديناميكيًا من نطاقات مدرجة في القائمة البيضاء باستخدام مكتبة متنوعة من حمولات حقن الأوامر غير المباشرة (indirect prompt injection)، مما يتيح إجراء اختبارات اختراق واقعية وقابلة للتكرار لوكلاء الذكاء الاصطناعي المتصفحين للويب في بيئات شبيهة ببيئات الإنتاج دون الاعتماد على صفحات وهمية.

Chia-Pei (Janet), Chen, Kentaroh Toyoda, Anita Lai, Alex Leung2026-05-13
🤖 AI

From Clever Hans to Scientific Discovery: Interpreting EEG Foundational Transformers with LRP

تُثبت هذه الورقة أن توسيع نطاق انتشار الصلة على مستوى الطبقة (LRP) ليشمل النماذج التأسيسية لتخطيط كهربية الدماغ (EEG) يتحقق بفعالية من عملية اتخاذ القرار لديها عبر كشف عيوب مثل سلوك "كليفر هانز" (Clever Hans)، ويولد فرضيات جديدة ذات صلة بيولوجية فيما يتعلق بأنماط نشاط الدماغ.

Justus Meyer zu Bexten, Nico Scherf, Bogdan Franczyk, Simon M. Hofmann2026-05-13
🤖 machine learning

Incentivizing Truthfulness and Collaborative Fairness in Bayesian Learning

تقترح هذه الورقة آلية مبتكرة تجمع بين القيم شبه الكاملة ودالة تقييم بيانات صادقة تعتمد على مجموعة تحقق غير معروفة لضمان كل من العدالة التعاونية والصدق في التعلم البايزي بشكل مثبت، مما يمنع التلاعب بالبيانات مع مكافأة مصادر البيانات بشكل عادل.

Rachael Hwee Ling Sim, Jue Fan, Xiao Tian, Xinyi Xu, Patrick Jaillet, Bryan Kian Hsiang Low2026-05-13
🤖 AI

Proteus: A Self-Evolving Red Team for Agent Skill Ecosystems

تقدم الورقة البحثية "بروتيوس" (Proteus)، وهو إطار عمل للفريق الأحمر ذاتي التطور يثبت أن أنظمة فحص المهارات الحالية تستهين بشكل كبير بالمخاطر الأمنية من خلال الكشف عن كيفية قيام المهاجمين المتكيفين والقائمين على التغذية الراجعة بتجاوز عمليات التدقيق بشكل تكراري لإنشاء متغيرات مهارات قاتلة للوكلاء.

Zhaojiacheng Zhou2026-05-13