💬 NLP

Evaluating the Creativity of LLMs in Persian Literary Text Generation

تقيم هذه الورقة الإبداع في النماذج اللغوية الكبيرة في توليد النصوص الأدبية الفارسية عبر مواضيع وأساليب بلاغية متنوعة باستخدام إطار عمل قائم على اختبار تورانس، مما يثبت أن الحكام الآليين من النماذج اللغوية الكبيرة يمكنهم تقييم الأصالة والطلاقة والمرونة والاستفاضة بشكل موثوق مقارنة بالتقييمات البشرية.

Armin Tourajmehr, Mohammad Reza Modarres, Yadollah Yaghoobzadeh2026-02-16
💬 NLP

VoiceAgentBench: Are Voice Assistants ready for agentic tasks?

تقدم الورقة البحثية VoiceAgentBench، وهو معيار شامل يتكون من أكثر من 6,000 استعلام صوتي اصطناعي عبر لغات متعددة ومستويات تعقيد مهامي مختلفة، لتكشف أنه في حين تتفوق مسارات ASR-LLM حاليًا على نماذج SpeechLM المتكاملة (end-to-end) في المهام الوكيلية، فإن جميع النماذج تعاني في تدفقات العمل المتسلسلة، والتعميم متعدد اللغات، ومتانة السلامة.

Dhruv Jain, Harshit Shukla, Gautam Rajeev, Ashish Kulkarni, Chandra Khatri, Shubham Agarwal2026-02-16
💬 NLP

Segmentation Beyond Defaults: Asymmetrical Byte Pair Encoding for Optimal Machine Translation Performance

تُثبت هذه الورقة أن استخدام ترميز زوج البايت غير المتماثل، الذي يطبق أعداداً مختلفة من عمليات الدمج للغتين المصدر والهدف (تحديداً عدداً عالياً للمصدر وعدداً منخفضاً للهدف)، يتفوق بشكل كبير على النهج المتماثل القياسي في الترجمة الآلية، لا سيما بالنسبة لأزواج اللغات ذات الموارد المنخفضة.

Saumitra Yadav, Manish Shrivastava2026-02-16
💬 NLP

SGM: Safety Glasses for Multimodal Large Language Models via Neuron-Level Detoxification

تقترح الورقة البحثية SGM، وهو تدخل على مستوى العصبونات بنظام الصندوق الأبيض وخالٍ من المعلمات، يعمل على كبح العصبونات الخبيرة السامة بشكل انتقائي في النماذج اللغوية الكبيرة متعددة الوسائط للتخفيف بفعالية من المخرجات الضارة في كل من السيناريوهات القياسية والعدائية مع الحفاظ على قدرات الطلاقة والاستنتاج.

Hongbo Wang, MaungMaung AprilPyone, Isao Echizen2026-02-16
💬 NLP

Finetuning Large Language Models for Automated Depression Screening in Nigerian Pidgin English: GENSCORE Pilot Study

تُظهر هذه الدراسة الاستطلاعية أن الضبط الدقيق للنماذج اللغوية الكبيرة على مجموعة بيانات منسقة من استجابات لغة "البيجين" النيجيرية يتيح فحصاً آلياً للاكتئاب عالي الدقة (94.5%) ومناسباً ثقافياً، مما يقدم حلاً قابلاً للتوسع للتغلب على حواجز اللغة والوصول في المجتمعات النيجيرية المحرومة.

Isaac Iyinoluwa Olufadewa, Miracle Ayomikun Adesina, Ezekiel Ayodeji Oladejo, Uthman Babatunde Usman, Owen Kolade Adeniy (…)2026-02-16
💬 NLP

Assessing and Improving Punctuation Robustness in English-Marathi Machine Translation

تقدم هذه الورقة البحثية "Viram"، وهو معيار تشخيصي للجمل الإنجليزية-الماراثية الغامضة بسبب علامات الترقيم، وتثبت أن كلاً من استعادة علامات الترقيم القائمة على التسلسل والضبط الدقيق المباشر يحسنان بشكل كبير من متانة الترجمة مقارنة بالنماذج اللغوية الكبيرة الحالية.

Kaustubh Shivshankar Shejole, Sourabh Deoghare, Pushpak Bhattacharyya2026-02-16
💬 NLP

Layer-wise Swapping for Generalizable Multilingual Safety

تقترح هذه الورقة طريقة لتبديل الطبقات واعية بالسلامة وخالية من التدريب، تقوم بنقل محاذاة السلامة من النماذج الخبيرة باللغة الإنجليزية إلى الخبراء في اللغات ذات الموارد المنخفضة عبر اختيار وحدات متخصصة بشكل تكيفي، مما يعزز السلامة متعددة اللغات دون المساس بالأداء اللغوي العام.

Hyunseo Shin, Wonseok Hwang2026-02-16
💬 NLP

Reinforced Attention Learning

تقدم هذه الورقة البحثية "تعلم الانتباه المعزز" (RAL)، وهو إطار عمل قائم على تدرج السياسة يعمل على تحسين توزيعات الانتباه الداخلية بدلاً من رموز المخرجات لتعزيز الإدراك والتجذر بشكل كبير في النماذج اللغوية الكبيرة متعددة الوسائط، متفوقاً بذلك على أساليب التعلم المعزز التقليدية وتقطير المعرفة القياسي عبر مختلف الاختبارات المرجعية.

Bangzheng Li, Jianmo Ni, Chen Qu, Ian Miao, Liu Yang, Xingyu Fu, Muhao Chen, Derek Zhiyuan Cheng2026-02-16
💬 NLP

SciClaimEval: Cross-modal Claim Verification in Scientific Papers

تقدم الورقة البحثية SciClaimEval، وهي مجموعة بيانات للتحقق من الادعاءات العلمية متعددة الوسائط تتميز بادعاءات وأدلة حقيقية مستمدة من تعديل الأشكال والجداول في الأوراق المنشورة، مما يكشف عن فجوات أداء كبيرة بين النماذج التأسيسية متعددة الوسائط الحالية والخبراء البشر، لا سيما في التحقق القائم على الأشكال.

Xanh Ho, Yun-Ang Wu, Sunisth Kumar, Tian Cheng Xia, Florian Boudin, Andre Greiner-Petter, Akiko Aizawa2026-02-16
💬 NLP

Bielik Guard: Efficient Polish Language Safety Classifiers for LLM Content Moderation

تقدم الورقة البحثية Bielik Guard، وهي عائلة من مصنفات سلامة اللغة البولندية الفعالة والمدمجة التي تم ضبطها بدقة على مجموعة بيانات مشروحة مجتمعيًا، والتي تصنف المحتوى بفعالية إلى خمسة مجالات للسلامة مع التفوق بشكل كبير على النماذج الحالية في معدلات الدقة والإنذارات الكاذبة.

Krzysztof Wróbel, Jan Maria Kowalski, Jerzy Surma, Igor Ciuciura, Maciej Szymański2026-02-16