🤖 machine learning

MetaMoE: Diversity-Aware Proxy Selection for Privacy-Preserving Mixture-of-Experts Unification

يُعد MetaMoE إطار عمل يحافظ على الخصوصية، حيث يوحد الخبراء المتخصصين في مجالات محددة والمدربين بشكل مستقل في نموذج واحد من نوع "خليط الخبراء" (Mixture-of-Experts)، وذلك عبر الاستفادة من الاختيار الواعي للتنوع في البيانات العامة البديلة لتقريب التوزيعات الخاصة وتنسيق تعلم الخبراء دون الوصول إلى بيانات العملاء الحساسة.

Weisen Jiang, Shuhao Chen, Sinno Jialin Pan2026-05-15
💬 NLP

Web Agents Should Adopt the Plan-Then-Execute Paradigm

تجادل هذه الورقة بأن على وكلاء الويب اعتماد نموذج "التخطيط ثم التنفيذ" بدلاً من نهج ReAct الافتراضي للتخفيف من مخاطر حقن الأوامر (prompt injection)، مؤكدة أن العائق الرئيسي أمام هذا التحول هو غياب واجهات برمجة تطبيقات المواقع الإلكترونية ذات النوعية والدلالية (typed, semantic APIs) وليس القيود في نماذج الذكاء الاصطناعي.

Julien Piet, Annabella Chow, Yiwei Hou, Muxi Lyu, Sylvie Venuto, Jinhao Zhu, Raluca Ada Popa, David Wagner2026-05-15
💬 NLP

To See is Not to Learn: Protecting Multimodal Data from Unauthorized Fine-Tuning of Large Vision-Language Model

تقترح هذه الورقة MMGuard، وهي آلية دفاع استباقية تولد أمثلة متعددة الوسائط غير قابلة للتعلم عن طريق حقن اضطرابات غير محسوسة للبشر وتعطيل الروابط بين الوسائط المتعددة لمنع الضبط الدقيق غير المصرح به لنماذج الرؤية واللغة الكبيرة، مما يحمي حقوق الطبع والنشر وخصوصية مالكي البيانات.

Chengshuai Zhao, Zhen Tan, Dawei Li, Zhiyuan Yu, Huan Liu2026-05-15
🤖 machine learning

Minimal-Intervention KV Retention: A Design-Space Study and a Diversity-Penalty Survivor

تُثبت هذه الورقة أن تعديلاً طفيفاً يعتمد على عقوبة التنوع في تقييم الاحتفاظ بذاكرة التخزين المؤقت لمفاتيح القيم (KV-cache) يتفوق على سبعة تصميمات هيكلية أكثر تعقيداً في مجال الاستدلال الرياضي طويل الصيغة تحت ميزانيات ذاكرة ضيقة، مما يرسخ بروتوكول تقييم صارماً ومسجلاً مسبقاً يكشف عن هذا التباين في الأداء.

Libo Sun, Po-wei Harn, Peixiong He, Xiao Qin2026-05-15
💬 NLP

Ideology Prediction of German Political Texts

تقترح هذه الورقة نهجاً قائماً على نموذج "ترانسفورمر" للتنبؤ بالتوجه السياسي للنصوص الألمانية على طيف مستمر من اليسار إلى اليمين، مبرهنةً من خلال تجارب على أربع مجموعات بيانات متميزة أن بنية النموذج وبيانات التدريب الخاصة بالمجال لا تقل أهمية عن حجم النموذج في تحقيق دقة عالية في تقدير الانحياز.

Sinclair Schneider, Florian Steuber, Joao A. G. Schneider, Gabi Dreo Rodosek2026-05-15
💬 NLP

LLM-based Detection of Manipulative Political Narratives

تقدم هذه الورقة إطاراً حوسبياً يجمع بين التلقين بلقطات قليلة ونماذج الاستدلال من أجل التصفية والتجميع غير الخاضع للإشراف لتحديد وهيكلة السرديات السياسية التضليلية المتميزة بفعالية من بين أكثر من 1.2 مليون منشور على وسائل التواصل الاجتماعي دون الاعتماد على فئات محددة مسبقاً.

Sinclair Schneider, Florian Steuber, Gabi Dreo Rodosek2026-05-15
💬 NLP

Herculean: An Agentic Benchmark for Financial Intelligence

تقدم الورقة البحثية "Herculean"، وهو أول معيار وكيل للذكاء المالي يقيم الوكلاء الاصطناعيين عبر أربعة تدفقات عمل معقدة (التداول، والتحوط، ورؤى السوق، والتدقيق) باستخدام بيئات معيارية قائمة على بروتوكول (MCP)، كاشفةً أنه في حين يؤدي الوكلاء بشكل جيد في التداول والرؤى، فإنهم يواجهون صعوبة كبيرة في التنسيق طويل الأمد والتحقق المنظم المطلوب لعمليات التحوط والتدقيق.

Xueqing Peng, Zhuohan Xie, Yupeng Cao, Haohang Li, Lingfei Qian, Yan Wang, Vincent Jim Zhang, Huan He, Xuguang Ai, Linha (…)2026-05-15
💬 NLP

A Formative Study of Brief Affective Text as a Complement to Wearable Sensing for Longitudinal Student Health Monitoring

تُظهر هذه الدراسة التي استمرت عاماً كاملاً على 458 طالباً جامعياً أن المحفزات النصية الموجزة للغاية والمفتوحة التي تلتقط المخاوف العاطفية تعزز بشكل كبير من القابلية للتفسير النفسي لبيانات أجهزة الاستشعار القابلة للارتداء السلبية، كاشفةً أن أبعاد اللغة الوجدانية وليس المواضيع المحددة هي المتنبئات الرئيسية لنتائج النوم والنشاط البدني.

Tamunotonye Harry, Johanna Hidalgo, Matthew Price, Yuanyuan Feng, Kathryn Stanton, Connie Tompkins, Peter Sheridan Dodds (…)2026-05-15
💬 NLP

Reinforcement Learning with Semantic Rewards Enables Low-Resource Language Expansion without Alignment Tax

تقترح هذه الورقة نهجاً للتعلم التعزيزي باستخدام تحسين السياسة النسبية للمجموعة (GRPO) مع مكافآت دلالية لتوسيع النماذج اللغوية الكبيرة إلى اللغات منخفضة الموارد، مما يخفف بفعالية من "ضريبة المحاذاة" والنسيان الكارثي الناتج عادةً عن الضبط الدقيق الخاضع للإشراف، مع الحفاظ على القدرات العامة وتحسين الجودة الدلالية.

Zeli Su, Ziyin Zhang, Zhou Liu, Xuexian Song, Zhankai Xu, Longfei Zheng, Xiaolu Zhang, Rong Fu, Guixian Xu, Wentao Zhang2026-05-15
💬 NLP

Where Should Diffusion Enter a Language Model? Geometry-Guided Hidden-State Replacement

تقدم الورقة البحثية نموذج DiHAL، وهو نموذج هجين موجه هندسياً يعمل على تحسين نماذج اللغة الانتشارية المستمرة من خلال تحديد الطبقات المثلى ضمن نماذج المحولات مسبقة التدريب لاستبدالها بجسر انتشار لإعادة بناء الحالة الخفية، مما يتجنب الاسترداد المباشر للرموز من المستمر إلى المتقطع ويحقق أداءً فائقاً.

Injin Kong, Hyoungjoon Lee, Yohan Jo2026-05-15