💬 NLP

Adapting Text LLMs to Speech via Multimodal Depth Up-Scaling

تقترح الورقة البحثية "رفع دقة العمق متعدد الوسائط" (Multimodal Depth Upscaling)، وهي طريقة تقوم بإدراج وتدريب طبقات محولة جديدة (مثل E-Branchformer) داخل نموذج لغوي كبير (LLM) نصي مجمد لتكييفه مع مهام الكلام، مما يحقق أداءً تنافسياً في التعرف التلقائي على الكلام (ASR) مع الحفاظ بشكل كبير على القدرات النصية الأصلية وتقليل المعلمات القابلة للتدريب مقارنة بالضبط الدقيق الكامل و(LoRA).

Kazuki Yano, Jun Suzuki, Shinji Watanabe2026-04-03
💬 NLP

A Japanese Benchmark for Evaluating Social Bias in Reasoning Based on Attribution Theory

تقدم هذه الورقة JUBAKU-v2، وهو معيار ياباني محدد ثقافياً يستند إلى نظرية العزو، والذي يقيم التحيزات الاجتماعية ضمن عمليات الاستدلال بدلاً من مجرد النتائج، مما يظهر حساسية فائقة في اكتشاف فروق أداء النماذج مقارنة بالمعايير الحالية القائمة على الترجمة.

Taihei Shiotani, Masahiro Kaneko, Naoaki Okazaki2026-04-03
💬 NLP

English to Central Kurdish Speech Translation: Corpus Creation, Evaluation, and Orthographic Standardization

تقدم هذه الورقة البحثية KUTED، وهو متن لغوي ضخم للترجمة الكلامية من اللغة الإنجليزية إلى الكردية المركزية مستمد من محاضرات TED، وتثبت أن تطبيق نهج منهجي لتوحيد الرسم الإملائي يحسن بشكل كبير أداء الترجمة لكل من نماذج Seamless التي تم ضبطها بدقة ونماذج Transformer المتتالية.

Mohammad Mohammadamini, Daban Q. Jaff, Josep Crego, Marie Tahon, Antoine Laurent2026-04-03
💬 NLP

TRIMS: Trajectory-Ranked Instruction Masked Supervision for Diffusion Language Models

تقترح الورقة البحثية إطار عمل TRIMS، وهو إطار ضبط دقيق مُشرف خفيف الوزن يستفيد من إشارات المعلم ذات التوليد الذاتي (autoregressive) لتوجيه القناع المدرك للمسار في نماذج اللغة الانتشارية (Diffusion Language Models)، مما يؤدي إلى حل عدم التطابق بين التدريب والاستدلال وتحسين المقايضة بين الدقة والتوازي بشكل كبير دون التكاليف العالية لعمليات التقطير التقليدية.

Lingjie Chen, Ruizhong Qiu, Yuyu Fan, Yanjun Zhao, Hanghang Tong2026-04-03
💬 NLP

AfrIFact: Cultural Information Retrieval, Evidence Extraction and Fact Checking for African Languages

تقدم هذه الورقة البحثية AfrIFact، وهي مجموعة بيانات متعددة اللغات للتحقق من الحقائق عبر عشر لغات أفريقية واللغة الإنجليزية، والتي تكشف عن قيود كبيرة في نماذج الاسترجاع والنماذج اللغوية الكبيرة القائمة على التحقق، بينما تُظهر أن التلقين بأسلوب التعلم من أمثلة قليلة (few-shot prompting) والضبط الدقيق المخصص للمهمة يمكن أن يحسنا الأداء بشكل كبير.

Israel Abebe Azime, Jesujoba Oluwadara Alabi, Crystina Zhang, Iffat Maab, Atnafu Lambebo Tonja, Tadesse Destaw Belay, Fo (…)2026-04-03
💬 NLP

LangMARL: Natural Language Multi-Agent Reinforcement Learning

يُعد LangMARL إطار عمل مبتكر يعالج مشكلة تخصيص الائتمان متعدد الوكلاء في الأنظمة القائمة على النماذج اللغوية الكبيرة من خلال تقديم تخصيص ائتمان لغوي على مستوى الوكيل وتطور التدرج في الفضاء اللغوي، مما يتيح صقل استراتيجية التنسيق الذاتي وتحسين كفاءة العينة في المهام التعاونية متعددة الوكلاء.

Huaiyuan Yao, Longchao Da, Xiaoou Liu, Charles Fleming, Tianlong Chen, Hua Wei2026-04-03
💬 NLP

From Baselines to Preferences: A Comparative Study of LoRA/QLoRA and Preference Optimization for Mental Health Text Classification

تقدم هذه الورقة دراسة مقارنة منهجية لاستراتيجيات التحسين الخاصة بتصنيف النصوص المتعلقة بالصحة النفسية، حيث تُظهر أن اختيار الطريقة وتكوينها يؤثران بشكل كبير على الأداء، وتدعو إلى إطار عمل شفاف قائم على المرجعية الأساسية يعطي الأولوية للرؤية المنهجية على حساب النتائج الرقمية البارزة المنفردة.

Mihael Arcan2026-04-03
💬 NLP

From Early Encoding to Late Suppression: Interpreting LLMs on Character Counting Tasks

تكشف هذه الورقة أن النماذج اللغوية الكبيرة غالباً ما تخفق في مهام عدّ الحروف ليس بسبب نقص في التمثيل الداخلي، بل لأن دوائر سلبية محددة في الطبقات اللاحقة تعمل بنشاط على كبح الإشارات الصحيحة لصالح مخرجات أخرى ذات احتمالية أعلى وغير صحيحة.

Ayan Datta, Mounika Marreddy, Alexander Mehler, Zhixue Zhao, Radhika Mamidi2026-04-03
💬 NLP

LinguDistill: Recovering Linguistic Ability in Vision- Language Models via Selective Cross-Modal Distillation

تُعد LinguDistill طريقة تقطير خالية من المهايئات تعمل على استعادة القدرات اللغوية المتدهورة لنماذج الرؤية واللغة عبر الاستفادة من نموذج لغوي مجمد كمعلم من خلال مشاركة ذاكرة التخزين المؤقت لمفاتيح وقيم (KV-cache) على مستوى الطبقات، مما يحقق استعادة كبيرة في الأداء على الاختبارات المعيارية اللغوية دون المساس بأداء المهام البصرية أو إضافة تعقيد معماري.

Patrick Amadeus Irawan, Erland Hilman Fuadi, Shanu Kumar, Alham Fikri Aji, Yova Kementchedjhieva2026-04-03
💬 NLP

Benchmarking and Mechanistic Analysis of Vision-Language Models for Cross-Depiction Assembly Instruction Alignment

تقدم هذه الورقة IKEA-Bench، وهو معيار شامل لتقييم نماذج الرؤية واللغة في محاذاة تعليمات التجميع عبر التمثيلات البصرية المختلفة، كاشفةً أن العائلة المعمارية تفوق عدد المعلمات أهميةً في الأداء، مع تحديد الفضاءات الفرعية البصرية المنفصلة والاستدلال المدفوع بالنص كعقبات ميكانيكية رئيسية.

Zhuchenyang Liu, Yao Zhang, Yu Xiao2026-04-03