💬 NLP

ANGOFA: Leveraging OFA Embedding Initialization and Synthetic Data for Angolan Language Model

تقدم هذه الورقة ANGOFA، وهي مجموعة من أربعة نماذج لغوية مدربة مسبقاً للغات الأنغولية تستفيد من التهيئة المعلوماتية للتضمين والبيانات الاصطناعية ضمن إطار عمل الضبط الدقيق التكيفي متعدد اللغات لتتفوق بشكل كبير على النماذج الحالية ذات الأداء العالي.

Osvaldo Luamba Quinjica, David Ifeoluwa Adelani2026-05-08
💬 NLP

Reinforced Informativeness Optimization for Long-Form Retrieval-Augmented Generation

تقدم هذه الورقة البحثية RioRAG، وهو إطار عمل يعزز التوليد المعزز بالاسترجاع طويل النص من خلال تعريف المعلوماتية كهدف قابل للتحقق، وتوظيف التحقق المرتكز على الجزيئات المعلوماتية (nugget-centric) وعبر المصادر لتوفير مكافآت كثيفة ومستقرة للتعلم التعزيزي دون الاعتماد على الإشراف المصنوع يدويًا أو النماذج المعلمة القوية.

Yuhao Wang, Ruiyang Ren, Yucheng Wang, Wayne Xin Zhao, Jing Liu, Hua Wu, Haifeng Wang2026-05-08
💬 NLP

How do datasets, developers, and models affect biases in a low-resourced language?: The Case of the Bengali Language

تثبت هذه الورقة تجريبيًا أن نماذج تحليل المشاعر للغة البنغالية ذات الموارد المنخفضة تظهر تحيزات مستمرة قائمة على النوع الاجتماعي والدين والجنسية بغض النظر عما إذا كانت مبنية على بنيات متعددة اللغات أو أحادية اللغة، مما يسلط الض الضوء على كيفية تسبب الجمع بين مجموعات البيانات المتنوعة والنماذج سابقة التدريب في إدخال عدم اتساق يؤدي إلى تفاقم الظلم المعرفي في الأنظمة الاجتماعية التقنية.

Dipto Das, Shion Guha, Bryan Semaan2026-05-08
💬 NLP

Searching the Internet for Challenging Benchmarks at Scale

تقدم هذه الورقة إطار عمل آلياً بالكامل وفعالاً من حيث التكلفة، يعمل على نمذجة الإنترنت كفضاء مواضيع شاسع ويستخدم استراتيجية "المتعدد الأذرع" (multi-armed bandit) لاكتشاف وبناء معايير اختبارية تحديّة بشكل ديناميكي تتجنب مشكلات التشبع التي تعاني منها مجموعات الاختبار الثابتة.

Wenda Xu, Vilém Zouhar, Parker Riley, Mara Finkelstein, Markus Freitag, Daniel Deutsch2026-05-08
💬 NLP

What MLLMs Learn about When they Learn about Multimodal Reasoning

تقدم هذه الورقة MathLens، وهو معيار مرجعي مبتكر يفكك الاستدلال متعدد الوسائط إلى مكونات الإدراك، والاستدلال، والمكونات الخاصة بالوسائط المتعددة ليكشف أن استراتيجيات التدريب مثل التعلم المعزز والضبط الدقيق الموجه للنصوص تنتج ملفات تعريف قدرات متميزة غير مرئية لمقاييس الدقة الإجمالية، مما يشير إلى أن التقدم الظاهري يعكس تحولات في التوازن بين المهارات الفرعية بدلاً من التقدم الموحد.

Jiwan Chung, Neel Joshi, Pratyusha Sharma, Youngjae Yu, Vibhav Vineet2026-05-08
💬 NLP

CompassLLM: A Multi-Agent Approach toward Geo-Spatial Reasoning for Popular Path Query

يُعد CompassLLM إطار عمل جديداً متعدد الوكلاء يستفيد من النماذج اللغوية الكبيرة لحل استعلامات المسارات الشائعة من خلال مرحلتين متتاليتين تتمثلان في البحث في المسارات التاريخية وتوليد مسارات جديدة، مما يوفر دقة فائقة وفعالية من حيث التكلفة مقارنة بالطرق التقليدية التي تتطلب تدريباً مكثفاً.

Md. Nazmul Islam Ananto, Shamit Fatin, Mohammed Eunus Ali, Md Rizwan Parvez2026-05-08
💬 NLP

Exploring Cross-Client Memorization of Training Data in Large Language Models for Federated Learning

تقترح هذه الورقة إطار عمل جديداً لقياس حفظ بيانات التدريب داخل العميل وبين العملاء في التعلم الاتحادي من خلال تكييف تقنيات قياس العينات الدقيقة من التعلم المركزي، مما يكشف أن نماذج التعلم الاتحادي تظهر مخاطر حفظ كبيرة تتأثر بعوامل تدريب واستدلال محددة.

Tinnakit Udsa, Can Udomcharoenchaikit, Patomporn Payoungkhamdee, Sarana Nutanong, Norrathep Rattanavipanon2026-05-08
💬 NLP

Catch Your Breath: Adaptive Computation for Self-Paced Sequence Production

تقدم الورقة البحثية "Catch Your Breath" (CYB)، وهي دالة خسارة خاضعة للإشراف يتم صياغتها كمسألة قرار متسلسلة تُمكّن النماذج التأسيسية من إدراج رموز التوقف ذاتياً وتكيفياً أثناء الاستدلال لتخصيص خطوات الحوسبة ديناميكياً، مما يؤدي إلى تحسين الارتباك (perplexity) ودقة المهام اللاحقة دون زيادة في التكاليف الحسابية أو تكاليف الذاكرة.

Alexandre Galashov, Matt Jones, Rosemary Ke, Yuan Cao, Vaishnavh Nagarajan, Michael C. Mozer2026-05-08
💬 NLP

Early Risk Prediction with Temporally and Contextually Grounded Clinical Language Processing

تقدم هذه الورقة البحثية HiTGNN، وهي شبكة عصبية رسومية زمنية هرمية، وReVeAL، وهو إطار عمل خفيف الوزن لوقت الاختبار، لتعزيز التنبؤ المبكر بمخاطر مرض السكري من النوع الثاني من خلال الاستفادة بفعالية من المعلومات الزمنية والسياقية الغنية في الملاحظات السريرية مع معالجة تحديات مثل قيود الخصوصية ومحدودية الموارد.

Rochana Chaturvedi, Yue Zhou, Andrew D. Boyd, Brian T. Layden, Mudassir Rashid, Lu Cheng, Ali Cinar, Barbara Di Eugenio2026-05-08
💬 NLP

Four Over Six: More Accurate NVFP4 Quantization with Adaptive Block Scaling

تقدم هذه الورقة تقنية "أربعة على ستة" (4/6)، وهي تقنية تغيير حجم الكتلة التكيفية لتكميم NVFP4 تعمل على تقليل خطأ التكميم من خلال ضبط مقاييس الكتل ديناميكيًا للتعامل بشكل أفضل مع القيم الكبيرة، مما يحقق أداءً في التدريب والاستدلال أقرب إلى BF16 مع حد أدنى من العبء الحسابي.

Jack Cook, Junxian Guo, Guangxuan Xiao, Yujun Lin, Song Han2026-05-08