💬 NLP

State-of-the-Art Arabic Language Modeling with Sparse MoE Fine-Tuning and Chain-of-Thought Distillation

تقدم الورقة البحثية نموذج Arabic-DeepSeek-R1، وهو نموذج لغوي كبير مفتوح المصدر للغة العربية يستفيد من بنية "خليط الخبراء" (MoE) المتفرقة واستراتيجية تقطير "سلسلة الأفكار" المستندة إلى السياق الثقافي لتحقيق أداء رائد عبر معايير قياسية شاملة، متفوقاً بذلك على الأنظمة المملوكة مثل GPT-5.1، ومثبتاً أن التكيف المتخصص يمكنه التغلب على عجز الأداء في اللغات غير الممثلة كفاية دون تكاليف التدريب المسبق على نطاق صناعي.

Navan Preet Singh, Anurag Garikipati, Ahmed Abulkhair, Jyani Akshay Jagdishbhai, Atul Yaduvanshi, Amarendra Chaudhary, M (…)2026-04-09
💬 NLP

When to Call an Apple Red: Humans Follow Introspective Rules, VLMs Don't

تقدم هذه الورقة مجموعة بيانات "نسب الألوان المتدرجة" (GCA) لتوضيح أنه في حين يظل البشر مخلصين لقواعدهم الاستبطانية في نسب الألوان، فإن النماذج اللغوية البصرية تنتهك بشكل منهجي استدلالاتها المعلنة، لا سيما عندما تتأثر بالمعارف المسبقة حول العالم، مما يكشف عن سوء معايرة جوهري في معرفتها الذاتية يتحدى موثوقيتها في عمليات النشر عالية المخاطر.

Jonathan Nemitz, Carsten Eickhoff, Junyi Jessy Li, Kyle Mahowald, Michal Golovanevsky, William Rudman2026-04-09
💬 NLP

Team Fusion@ SU@ BC8 SympTEMIST track: transformer-based approach for symptom recognition and linking

يعالج نظام Team Fusion@SU@BC8 تحدي SympTEMIST من خلال توظيف مسار عمل قائم على المحولات يجمع بين نموذج RoBERTa-BiLSTM-CRF مضبوط بدقة للتعرف على الأعراض ومنهج SapBERT عابر للغات لربط الكيانات، مما يثبت أن اختيار قاعدة المعرفة هو العامل الأكثر أهمية للدقة.

Georgi Grazhdanski, Sylvia Vassileva, Ivan Koychev, Svetla Boytcheva2026-04-09
💬 NLP

Learning to Interrupt in Language-based Multi-agent Communication

تقدم هذه الورقة HANDRAISER، وهو إطار عمل قائم على التعلم يُمكّن وكلاء الاستماع من مقاطعة المتحدثين في نقاط مثالية بناءً على المكافآت والتكاليف المقدرة، مما يقلل من عبء الاتصالات بنسبة 32.2% مع الحفاظ على أداء المهام أو تحسينه عبر سيناريوهات متنوعة متعددة الوكلاء.

Danqing Wang, Da Yin, Ruta Desai, Lei Li, Asli Celikyilmaz, Ansong Ni2026-04-09
💬 NLP

Context-Aware Dialectal Arabic Machine Translation with Interactive Region and Register Selection

تقدم هذه الورقة إطار عمل مدركاً للسياق وقابلاً للتوجيه للترجمة الآلية للغة العربية، يستخدم مسار تعزيز بيانات قائماً على القواعد لتوليد مجموعة بيانات لهجات متوازنة، مما يتيح تحكماً في المخرجات عبر ثمانية تنوعات إقليمية وسجلات اجتماعية، مع إثبات أن مقاييس BLEU القياسية قد تفشل في رصد الأصالة الثقافية الفائقة والخصوصية اللهجوية التي تتميز بها هذه النماذج مقارنة بالنماذج المرجعية عالية الموارد.

Afroza Nowshin, Prithweeraj Acharjee Porag, Haziq Jeelani, Fayeq Jeelani Syed2026-04-09
💬 NLP

ValueGround: Evaluating Culture-Conditioned Visual Value Grounding in MLLMs

تقدم هذه الورقة البحثية ValueGround، وهو معيار مرجعي جديد يقيم قدرة النماذج اللغوية الكبيرة متعددة الوسائط على مواءمة الأحكام القيمية المشروطة ثقافياً مع التمثيلات البصرية، مما يكشف عن انخفاض كبير في الأداء عند الانتقال من الخيارات النصية فقط إلى الخيارات المصورة.

Zhipin Wang, Christoph Leiter, Christian Frey, Mohamed Hesham Ibrahim Abdalla, Josif Grabocka, Steffen Eger2026-04-09
💬 NLP

Closing the Speech-Text Gap with Limited Audio for Effective Domain Adaptation in LLM-Based ASR

تُثبت هذه الورقة أن دمج كمية صغيرة من البيانات المقترنة بين الكلام والنص (بنسبة ضئيلة تصل إلى 10% من المجال المستهدف) في استراتيجية التكيف القائمة على الدفعات المختلطة يسد فجوة النمط بفعالية في أنظمة التعرف التلقائي على الكلام القائمة على النماذج اللغوية الكبيرة، محققاً أداءً يضاهي الضبط الدقيق للبيانات الكاملة مع الاستفادة من كفاءة التكيف المعتمد على النصوص فقط.

Thibault Bañeras-Roux, Sergio Burdisso, Esaú Villatoro-Tello, Dairazalia Sánchez-Cortés, Shiran Liu, Severin Baroudi, Sh (…)2026-04-09
💬 NLP

MedConclusion: A Benchmark for Biomedical Conclusion Generation from Structured Abstracts

تقدم الورقة البحثية MedConclusion، وهي مجموعة بيانات ضخمة تضم 5.7 مليون ملخص مهيكل من PubMed، صُممت لاختبار وتطوير قدرة النماذج اللغوية الكبيرة على توليد استنتاجات علمية من الأدلة الطبية الحيوية، مع تسليط الض الضوء على التحديات المتميزة لتوليد الاستنتاجات مقارنة بالتلخيص.

Weiyue Li, Ruizhi Qian, Yi Li, Yongce Li, Yunfan Long, Jiahui Cai, Yan Luo, Mengyu Wang2026-04-09
💬 NLP

Fine-tuning Whisper for Pashto ASR: strategies and scale

تتناول هذه الورقة فشل نماذج "ويسبير" (Whisper) المدربة مسبقاً على لغة البشتو من خلال إثبات أن الضبط الدقيق الكامل التقليدي (vanilla full fine-tuning) على بيانات "كومون فويس" (CommonVoice) للغة البشتو يتفوق بشكل كبير على استراتيجيات التعلم بنقل المعرفة والتعلم كفء المعلمات، مما يحدد نموذج "ويسبير-سمول" (whisper-small) كحجم النموذج الأمثل لـ 113 ساعة المتاحة من بيانات التدريب، مع تحديد أنماط أخطاء صرفية وصوتية محددة.

Hanif Rahman2026-04-09
💬 NLP

The Illusion of Stochasticity in LLMs

تُثبت هذه الورقة أنه بينما يمكن للنماذج اللغوية الكبيرة استخدام البذور العشوائية المقدمة لتوليد توزيعات مستهدفة، إلا أنها تفشل بشكل جوهري في أخذ عينات بشكل موثوق ومباشر من توزيعات محددة بناءً على تقديراتها الاحتمالية الداخلية، مما يمثل قصوراً حرجاً لاستخدامها كأنظمة وكيلة.

Xiangming Gu, Soham De, Michalis Titsias, Larisa Markeeva, Petar Veličković, Razvan Pascanu2026-04-09