💬 NLP

LLM Probe: Evaluating LLMs for Low-Resource Languages

تقدم هذه الورقة "LLM Probe"، وهو إطار تقييم قائم على المعجم ومجموعة بيانات مرجعية مصاحبة للغات ذات الموارد المنخفضة، والتي تكشف عن فروق أداء متميزة بين النماذج السببية ونماذج تسلسل إلى تسلسل عبر مهام مثل المحاذاة المعجمية، والتحليل الصرفي النحوي، والترجمة، وذلك للدعوة إلى تقييم قائم على الأسس اللغوية في تطوير الذكاء الاصطناعي متعدد اللغات.

Hailay Kidu Teklehaymanot, Gebrearegawi Gebremariam, Wolfgang Nejdl2026-04-01
💬 NLP

Impact of enriched meaning representations for language generation in dialogue tasks: A comprehensive exploration of the relevance of tasks, corpora and metrics

تُظهر هذه الدراسة أن إثراء تمثيلات المعنى بأمثلة خاصة بالمهمة يحسن جودة توليد الحوار بشكل كبير، لا سيما في المهام المعقدة، ومجموعات البيانات الصغيرة، وإعدادات التعلم الصفري، مع تسليط الضوء على أن المقاييس الدلالية التي يدربها البشر تتفوق على المقاييس اللفظية في تقييم هذه المخرجات.

Alain Vázquez, Maria Inés Torres2026-04-01
💬 NLP

Baby Scale: Investigating Models Trained on Individual Children's Language Input

تستقصي هذه الورقة النماذج اللغوية المدربة على مجموعات بيانات بمقياس طفلي من مجموعة بيانات "بيبي فيو" (BabyView)، كاشفةً أنه بينما تُظهر هذه النماذج توسعاً واعداً في القواعد، فإن أداءها يتباين بشكل كبير بناءً على سمات المدخلات التفاعلية والتوزيعية ويتلازم مع تعلم الكلمات لدى الأطفال البشر، مما يقدم رؤى حول كل من التدريب الفعال للنماذج صغيرة النطاق والاكتساب اللغوي البشري.

Steven Y. Feng, Alvin W. M. Tan, Michael C. Frank2026-04-01
💬 NLP

Can LLM Agents Identify Spoken Dialects like a Linguist?

تتقصى هذه الورقة ما إذا كان بإمكان النماذج اللغوية الكبيرة، عند تزويدها بموارد لغوية ونصوص منسوخة ناتجة عن أنظمة التعرف التلقائي على الكلام، تصنيف اللهجات السويسرية بفعالية تضاهي النماذج المتخصصة مثل HuBERT واللغويين البشر.

Tobias Bystrich, Lukas Hamm, Maria Hassan, Lea Fischbach, Lucie Flek, Akbar Karimi2026-04-01
💬 NLP

Bringing Up a Bilingual BabyLM: Investigating Multilingual Language Acquisition Using Small-Scale Models

تستخدم هذه الورقة نماذج GPT-2 صغيرة الحجم مدربة على مجموعات بيانات ثنائية اللغة متطابقة ومتحكم بها لتوضيح أن المتعلمين الإحصائيين يمكنهم اكتساب لغتين في آن واحد دون تأخيرات متأصلة أو عجز في الأداء، مما يشير إلى أن أنظمة التعرض اللغوي المتنوعة لا تشكل أي تحديات جوهرية لاكتساب اللغة.

Linda Zeng, Steven Y. Feng, Michael C. Frank2026-04-01
💬 NLP

When Can We Trust LLM Graders? Calibrating Confidence for Automated Assessment

تُثبت هذه الورقة أن مطالبة النماذج اللغوية الكبيرة بالإبلاغ عن مستوى ثقتها ذاتياً هي وسيلة أكثر فعالية من حيث التكلفة وضبط المعايرة مقارنة بالتصويت عبر الاتساق الذاتي لتحديد تنبؤات التقييم الآلي الموثوقة، مما يتيح أتمتة انتقائية فعالة حيث تُعالج المخرجات عالية الثقة آلياً بينما تُرفع الحالات غير اليقينية للمراجعة البشرية.

Robinson Ferrer, Damla Turgut, Zhongzhou Chen, Shashank Sonkar2026-04-01
💬 NLP

Semantic Interaction for Narrative Map Sensemaking: An Insight-based Evaluation

تقدم هذه الورقة دراسة مستخدم توضح أن الخرائط السردية المُمكّنة من التفاعل الدلالي تتفوق بشكل كبير على النماذج المرجعية المعتمدة على الخط الزمني في مهام صنع المعنى، وذلك من خلال تسهيل استخلاص رؤى أعمق وتوفير مسارات تصحيحية وإضافية للمحللين لتنقيح السرديات المستخرجة بواسطة الذكاء الاصطناعي مع تقليل التلاعب بالمعلمات.

Brian Felipe Keith-Norambuena, Fausto German, Eric Krokos, Sarah Joseph, Chris North2026-04-01
💬 NLP

Agenda-based Narrative Extraction: Steering Pathfinding Algorithms with Large Language Models

تقدم هذه الورقة البحثية استخراج السرد القائم على الأجندة، وهي طريقة تدمج النماذج اللغوية الكبيرة في خوارزميات البحث عن المسار لتوجيه بناء الحبكة نحو وجهات نظر محددة من قبل المستخدم مع الحفاظ على تماسك سردي عالٍ ودعم مسارات قصصية متعددة.

Brian Felipe Keith-Norambuena, Carolina Inés Rojas-Córdova, Claudio Juvenal Meneses-Villegas, Elizabeth Johanna Lam-Esqu (…)2026-04-01
💬 NLP

A Comprehensive Information-Decomposition Analysis of Large Vision-Language Models

تقدم هذه الورقة إطار عمل مبتكرًا باستخدام تفكيك المعلومات الجزئي للتحليل الكمي لعمليات اتخاذ القرار الداخلية لـ 26 نموذجًا ضخمًا من نماذج الرؤية واللغة، مما يكشف عن أنظمة مهام متميزة، واستراتيجيات متباينة على مستوى العائلة، والدور الحاسم لضبط التعليمات البصرية في تحقيق دمج متعدد الوسائط حقيقي.

Lixin Xiu, Xufang Luo, Hideki Nakayama2026-04-01
💬 NLP

Training-Free Dynamic Upcycling of Expert Language Models

تقدم هذه الورقة البحثية طريقة "الارتقاء الديناميكي بالتدوير" (DUME)، وهي طريقة لا تتطلب تدريباً لبناء نموذج "خليط من الخبراء" (MoE) موحد وقابل للتوسع بكفاءة عبر إعادة استخدام خبراء كثيفين مدربين مسبقاً باستخدام حل انحدار ريجي (ridge regression) مغلق الصيغة، مما يحافظ على القدرات الأصلية المحددة لكل مجال بل ويتجاوزها في كثير من الأحيان دون الحاجة إلى ضبط دقيق إضافي أو المعاناة من النسيان الكارثي.

Eros Fanì, Oğuzhan Ersoy2026-04-01