💬 NLP

Beyond Self-Knowledge: Propagating Uncertainty Across Reasoning and Retrieval in LLMs

تقدم الورقة البحثية BeyondUncertainty، وهي طريقة لتوليد النصوص المعزز بالاسترجاع تستفيد من الثقة اللفظية من النماذج اللغوية لتوجيه الاستعلامات بشكل انتقائي إلى عملية الاسترجاع، مما يحقق دقة محسنة وتقليلاً في استخدام الرموز (tokens) مقارنة بالنماذج المرجعية التي تعتمد دائماً على الاسترجاع أو لا تعتمد عليه أبداً، وذلك رغم تحمل عبء إضافي طفيف ناتج عن فحص الثقة الأولي.

Chandan Kumar Sah, Xiaoli Lian, Li Zhang2026-07-29
💬 NLP

A Human-in-the-Loop Corpus for LLM-Based Simplification of Scientific Summaries

تقدم هذه الورقة سير عمل يعتمد على وجود الإنسان في الحلقة، ومتنًا جديدًا مشتقًا من SciSummNet يستفيد من نموذج GPT-4o-mini وتعليقات الخبراء لإنشاء ملخصات علمية سهلة الوصول، مما يثبت أنه بينما تعمل التبسيطات المولدة بواسطة الذكاء الاصطناعي على تحسين القدرة على الاستيعاب لغير المتخصصين، فإن الخبراء البشريين ضروريون للحفاظ على المصطلحات التخصصية الحرجة وقوة الادعاء.

Kyuri Im, Michael Färber2026-07-29
💬 NLP

MyMentorLLM: A psychotherapy GenAI environment with multimodal voice/text patients, trainees and experts for deliberate practice

تقدم الورقة البحثية MyMentorLLM، وهي بيئة محاكاة صوتية ونصية متعددة الوسائط تولد أكثر من 2000 جلسة تدريبية معيارية في العلاج المعرفي السلوكي لتقييم وتحسين دقة التشخيص والاستجابة العاطفية لدى المتدربين من المعالجين من خلال الإشراف الخبير.

Rodolfo Rizzi, Alessandro Grecucci, Massimo Stella2026-07-29
💬 NLP

SpeechLLM Meets Federated Learning for End-to-End ASR: English and Italian Case Studies

تقدم هذه الورقة أول دراسة منهجية للتعلم الاتحادي المخصص لنماذج اللغة الصوتية (SpeechLLM) في أنظمة التعرف التلقائي على الكلام (ASR) من طرف إلى طرف، حيث تقدم استراتيجية تحسين فعالة من حيث الاتصال تحقق أداءً تنافسياً في اللغتين الإنجليزية والإيطالية مع معالجة تحديات الخصوصية والقابلية للتوسع في البيئات الموزعة.

Mohamed Nabih Ali, Daniele Falavigna, Alessio Brutti2026-07-29
💬 NLP

WorkSurface-Bench: Benchmarking Enterprise Agents on Multi-Surface Knowledge Routing

تقدم هذه الورقة البحثية WorkSurface-Bench، وهو معيار مرجعي جديد يتكون من 1,151 مهمة قابلة للتدقيق صُممت لتقييم قدرة الوكلاء المؤسسيين على توجيه الاستعلامات عبر أسطح معرفية متباينة (مستندات، وجداول، ورسوم بيانية)، مما يكشف أنه في حين يمكن للوكلاء تحقيق دقة عالية في التوجيه، فإن الاختيار الصحيح للسطح وحده لا يكفي لتحقيق معدلات مرتفعة لإنجاز المهام.

Hao Liang, Meiyi Qiang, Sizhe Qiu, Linzhuang Sun, Wentao Zhang2026-07-29
💬 NLP

Evaluation of Adversarial Robustness in Arabic Language Models

تقيم هذه الدراسة المتانة التنافسية لخمسة نماذج لغوية عربية متطورة ضد الهجمات على مستوى الحروف والكلمات والجمل، مما يكشف عن ثغرات كبيرة تجاه التشكيل والتلاعب بأدوات الربط وإعادة الصياغة، مع إظهار أن التدريب التنافسي يقدم دفاعاً جزئياً ولكنه غير مكتمل.

Anwar Alajmi, Ayed Salman, Imtiaz Ahmad2026-07-29
💬 NLP

AngelSpec: Towards Real-World High Performance Inference with Speculative Decoding

يقدم AngelSpec إطار عمل تدريب موحد يخصص تخصصاً مشتركاً لهياكل صياغة متميزة (MTP للدردشة وblock-diffusion للكود والرياضيات) ويحسن ديناميكياً موارد التحقق من الاستنتاج لتحقيق تحسينات كبيرة في معدل الإنتاجية ومعدلات قبول أعلى عبر مختلف أعباء العمل الواقعية المتنوعة.

Hong Liu, Rui Cen, Junhan Shi, Guangshuo Qin, Jiebin Zhang, Tianyu Liu, Runzhi Fan, Guoliang Zhao, Ruobing Xie, Kai Zhan (…)2026-07-29
💬 NLP

Shieldstral

يُعد Shieldstral نموذجاً مصنفاً للسلامة متعدد الوسائط، متكيف السياسات، ومدمجاً بحجم 3 مليارات معلمة، يعمل على توحيد مهام الإشراف على المحتوى المتنوعة ضمن إطار عمل قائم على الإجابة عن أسئلة ثنائية، مما يمكّنه من مضاهاة أو تجاوز النماذج الأكبر حجماً بكثير من خلال مجموعة بيانات ضخمة ومنقحة تضم 54.1 مليون عينة.

Antonia Calvi, Avinash Sooriyarachchi, Giada Pistilli, Guillaume Lample, Maarten Buyl, Maximilian Augustin, Maximilian M (…)2026-07-29
💬 NLP

Stemma: Induced Decision Regions Reveal LLM Provenance

تقدم هذه الورقة Stemma، وهي طريقة قوية تعتمد على الصندوق الأسود لاختبار أصل النماذج اللغوية الكبيرة، تقوم برسم خرائط للمخرجات مفتوحة النهاية إلى مناطق قرار مستحثة للتغلب على اختلافات الصيغة السطحية، محققةً دقة هي الأفضل في فئتها عبر مختلف تحولات النماذج وإعدادات النشر.

Keyu Zhang, Vadim Safronov, Andrew Martin2026-07-29
💬 NLP

RSIBench-Data: Benchmarking Data-Centric Research for Recursive Self-Improvement

تقدم الورقة البحثية RSIBench-Data، وهو معيار ضبط يوضح أنه بينما تستطيع وكلاء النماذج اللغوية الكبيرة (LLM agents) تحديد وتطوير استراتيجيات تركز على البيانات بشكل مستقل لتحسين أداء النموذج، إلا أنها تعاني حالياً من صعوبة في ترجمة التغذية الراجعة باستمرار إلى مكاسب مستدامة، مما يسلط الضوء على الفجوة بين الاكتشاف الأولي والتحسين الذاتي المتكرر الموثوق.

Fanqing Meng, Lingxiao Du, Qiguang Chen, Ziqi Zhao, Haocheng Lu, Mengkang Hu, Michael Qizhe Shieh2026-07-29