🤖 machine learning

Learning Locally, Revising Globally: Global Reviser for Federated Learning with Noisy Labels

تقترح هذه الورقة البحثية "المراجع العالمي الاتحادي" (FedGR)، وهي طريقة مبتكرة تستفيد من الذاكرة البطيئة المتأصلة في النموذج العالمي تجاه الملصقات الصاخبة لتصحيح ضجيج الملصقات وتنظيم التدريب المحلي بشكل تعاوني، مما يحقق متانة فائقة ضد ضجيج الملصقات غير المتجانس في التعلم الاتحادي مقارنة بالنماذج المرجعية الرائدة.

Yuxin Tian, Mouxing Yang, Yuhao Zhou, Jian Wang, Qing Ye, Tongliang Liu, Gang Niu, Jiancheng Lv2026-05-04
🤖 AI

Preference Goal Tuning: Post-Training as Latent Control for Frozen Policies

تقدم هذه الورقة البحثية "ضبط أهداف التفضيل" (PGT)، وهو إطار عمل لما بعد التدريب يعمل على مواءمة السياسات المشروطة بالأهداف والمجمدة مع تفضيلات المهام من خلال تحسين تضمينات أهداف كامنة مستمرة بدلاً من تحديث معاملات السياسة، مما يحقق أداءً فائقاً ومتانة أعلى مقارنة بكل من مطالبات الخبراء والضبط الدقيق الكامل على معيار Minecraft SkillForge.

Guangyu Zhao, Kewei Lian, Haoxuan Ru, Borong Zhang, Haowei Lin, Zhancun Mu, Haobo Fu, Qiang Fu, Shaofei Cai, Zihao Wang (…)2026-05-04
⚡ electrical engineering

Distance-Aware Error for Spline Networks: A Bottom-Up Approach to Uncertainty

تقدم هذه المساهمة نهجاً حتمياً من أسفل إلى أعلى لاستخلاص حدود الخطأ المعتمدة على المسافة في الشبكات العصبية الشريطية (spline neural networks)، بما في ذلك شبكات كولموغوروف-أرنولد، من خلال تحليل أخطاء الخلايا العصبية الفردية وانتشارها عبر التركيبات، مما يثبت سرعة وموثوقية متفوقتين مقارنة بالنماذج الاحتمالية المرجعية في تطبيقات مثل تقدير الشكل والملاحة الآمنة.

Masoud Ataei, Mohammad Javad Khojasteh, Vikas Dhiman2026-05-04
🔢 mathematics

Mean-field limit from general mixtures of experts to quantum neural networks

تُثبت هذه المقالة انتشار الفوضى وتوفر معدلات تقارب صريحة للحد ذي المجال المتوسط لنماذج "خليط الخبراء" (Mixture-of-Experts) المدربة عبر التدفق المتدرج، وذلك من خلال إثبات تقاربها التقاربي إلى معادلة استمرارية غير خطية وتطبيق هذه النتائج على الشبكات الكمومية العصبية.

Anderson Melchor Hernandez, Davide Pastorello, Giacomo De Palma2026-05-04
📊 statistics

Doubly robust identification of treatment effects from multiple environments

تقدم هذه الورقة RAMEN، وهي خوارزمية تحقق تحديداً متيناً بشكل مزدوج لآثار العلاج من بيئات رصدية متعددة عبر الاستفطادة من فرضيات عدم التجانس والتباين دون الحاجة إلى معرفة الرسم البياني السببي الأساسي.

Piersilvio De Bartolomeis, Julia Kostin, Javier Abad, Yixin Wang, Fanny Yang2026-05-04
🤖 machine learning

DiffMI: Breaking Face Recognition Privacy via Diffusion-Driven Training-Free Model Inversion

تقدم هذه الورقة البحثية DiffMI، وهو هجوم قلب نموذج (model inversion attack) جديد لا يتطلب تدريباً، يستفيد من نماذج الانتشار (diffusion models) لإعادة بناء الهويات الوجهية غير المرئية من التضمينات (embeddings) بكفاءة وأمانة، متفوقاً بشكل كبير على الأساليب الحالية القائمة على شبكات الخصومة التوليدية (GANs) في كل من معدل النجاح والقدرة على التكيف.

Hanrui Wang, Shuo Wang, Chun-Shien Lu, Isao Echizen2026-05-04
💬 NLP

Comparing Exploration-Exploitation Strategies of LLMs and Humans: Insights from Standard Multi-armed Bandit Experiments

تقارن هذه الدراسة بين استراتيجيات الاستكشاف والاستغلال لنماذج اللغات الكبيرة، والبشر، والخوارزميات في مهام "المتعدد الأذرع" (multi-armed bandit)، وتجد أنه بينما يجعل تمكين "التفكير" نماذج اللغات الكبيرة أكثر شبهاً بالبشر في البيئات المستقرة، إلا أنها لا تزال تعاني لتحقيق القدرة البشرية على التكيف والاستكشاف الموجه في البيئات المعقدة وغير المستقرة.

Ziyuan Zhang, Darcy Wang, Ningyuan Chen, Rodrigo Mansur, Vahid Sarhangian2026-05-04
🤖 machine learning

TokenWeave: Efficient Compute-Communication Overlap for Distributed LLM Inference

يُعد TokenWeave نظاماً مبتكراً يحقق تداخلاً فعالاً بين الحوسبة والاتصال في عمليات الاستنتاج الموزعة للنماذج اللغوية الكبيرة ذات الدفعات الصغيرة، وذلك عبر دمج عملية RMSNorm مع اتصالات AllReduce باستخدام ميزات متخصصة في وحدات معالجة الرسومات، مما يقلل زمن الاستجابة ويزيد من معدل الإنتاجية حتى عندما يكون عدد الرموز لكل تكرار منخفضاً بقدر 1024 رمزاً.

Raja Gond, Nipun Kwatra, Ramachandran Ramjee2026-05-04
🤖 AI

A Benchmark Dataset for Graph Regression with Homogeneous and Multi-Relational Variants

تقدم هذه المساهمة RelSC، وهي مجموعة بيانات مرجعية مبتكرة لمهام الانحدار على الرسوم البيانية مستمدة من رسوم بيانية برمجية مع تسميات وقت التشغيل، والمتاحة في كل من نسختي الرسوم المتجانسة ومتعددة العلاقات لتقييم كيفية تأثير قرارات التمثيل الهيكلي على أداء النموذج.

Peter Samoaa, Marcus Vukojevic, Morteza Haghir Chehreghani, Antonio Longa2026-05-04