💬 NLP

Evaluating LLM-Generated Lessons from the Language Learning Students' Perspective: A Short Case Study on Duolingo

تكشف دراسة الحالة هذه لخمسة موظفين من شركات متعددة الجنسيات في الفلبين أنه بينما تساهم السيناريوهات العامة التي أنشأها نموذج لغوي كبير (LLM) في تطبيق "دولينجو" بفعالية في بناء مهارات لغوية تأسيسية، فإن نقص المحتوى المتخصص مهنياً يعيق الطلاقة المهنية، مما يستدعي توصية للتطبيقات بتبني سيناريوهات دروس مخصصة ومرتبطة بمجالات محددة إلى جانب السيناريوهات العامة.

Carlos Rafael Catalan, Patricia Nicole Monderin, Lheane Marie Dizon, Gap Estrella, Raymund John Sarmimento, Marie Antoin (…)2026-03-20
💬 NLP

Progressive Training for Explainable Citation-Grounded Dialogue: Reducing Hallucination to Zero in English-Hindi LLMs

تقدم هذه الورقة البحثية XKD-Dial، وهو مسار تدريب تصاعدي مكون من أربع مراحل لأنظمة الحوار ثنائية اللغة (الإنجليزية-الهندية) يستفيد من الضبط الدقيق الخاضع للإشراف والمستند إلى الاستشهاد للقضاء على الهلوسة، ويستخدم تحليلات القابلية للتفسير متعددة الأوجه لإثبات كيف يمكن للنماذج الأصغر تحقيق أداء يضاهي النماذج الأكبر مع الحفاظ على معدلات صفر من الهلوسة.

Vedant Pandya2026-03-20
💬 NLP

A conceptual framework for ideology beyond the left and right

تقدم هذه الورقة إطاراً مفاهيمياً جديداً يتجاوز المحور الحزبي التقليدي (يمين-يسار) لنمذجة الأيديولوجيا كشبكة مفاهيمية معرفية-اجتماعية متعددة المستويات، وبذلك تجمع بين الأساليب الحسابية ونظرية الأيديولوجيا لتمكين تحليل أغنى للخطاب الاجتماعي وتوضيح التداخلات بين مهام معالجة اللغات الطبيعية الحالية.

Kenneth Joseph, Kim Williams, David Lazer2026-03-20
💬 NLP

Hypothesis-Conditioned Query Rewriting for Decision-Useful Retrieval

تقدم هذه الورقة البحثية إطار عمل "إعادة كتابة الاستعلام المشروط بالفرضية" (HCQR)، وهو إطار عمل لا يتطلب تدريباً يعمل على تعزيز اتخاذ القرار في عملية التوليد المعزز بالاسترجاع من خلال تحويل استعلام أولي واحد إلى ثلاثة عمليات بحث مستهدفة مصممة لدعم وتمييز والتحقق من الفرضيات، مما يؤدي إلى تفوقه على الأساليب الحالية في الاختبارات المرجعية الطبية مثل MedQA وMMLU-Med.

Hangeol Chang, Changsun Lee, Seungjoon Rho, Junho Yeo, Jong Chul Ye2026-03-20
💬 NLP

Parallelograms Strike Back: LLMs Generate Better Analogies than People

تُظهر هذه الدراسة أن النماذج اللغوية الكبيرة تُنتج نظائر لفظية رباعية الأطراف ذات جودة أعلى من البشر من خلال التزامها الأكثر اتساقاً بالبنية العلاقاتية الهندسية لـ "متوازي الأضلاع"، مما يشير إلى أن الفشل الملحوظ في الإدراك البشري ينبع من عدم الاتساق البشري وليس من عدم كفاءة النموذج.

Qiawen Ella Liu, Raja Marjieh, Jian-Qiao Zhu, Adele E. Goldberg, Thomas L. Griffiths2026-03-20
💬 NLP

A Dataset and Resources for Identifying Patient Health Literacy Information from Clinical Notes

تقدم هذه الورقة HEALIX، وهي أول مجموعة بيانات مشروحة متاحة للجمهور وتتكون من 589 ملاحظة سريرية صُممت لتسهيل الكشف الآلي عن مستويات الثقافة الصحية للمرضى، وتبرهن على فائدتها من خلال قياس استراتيجيات التلقين صفرية المحتوى (zero-shot) وقليلة المحتوى (few-shot) عبر أربعة نماذج لغوية كبيرة مفتوحة المصدر.

Madeline Bittner, Dina Demner-Fushman, Yasmeen Shabazz, Davis Bartels, Dukyong Yoon, Brad Quitadamo, Rajiv Menghrajani (…)2026-03-20
💬 NLP

Serendipity by Design: Evaluating the Impact of Cross-domain Mappings on Human and LLM Creativity

تكشف هذه الدراسة أنه في حين أن فرض عمليات الربط بين المجالات المتباينة يعزز الإبداع البشري بشكل كبير، فإن النماذج اللغوية الكبيرة تولد بالفعل أفكاراً أكثر أصالة في المتوسط ولا تظهر فائدة ذات دلالة إحصائية من التدخل نفسه، رغم أن كلا النظامين ينتجان مخرجات أكثر ابتكاراً عندما يكون المجال المصدر بعيداً دلالياً عن المجال المستهدف.

Qiawen Ella Liu, Marina Dubova, Henry Conklin, Takumi Harada, Thomas L. Griffiths2026-03-20
💬 NLP

How Uncertainty Estimation Scales with Sampling in Reasoning Models

تُثبت هذه الورقة أنه بينما يتحسن كل من الاتساق الذاتي والثقة اللفظية مع أخذ العينات في نماذج الاستدلال، فإن مُقدِّرًا هجينًا يجمع بين هاتين الإشارتين يحقق تقديرًا فائقًا لعدم اليقين بأقل عدد من العينات، متميزًا بشكل خاص في الرياضيات مقارنة بمجالات العلوم والتكنولوجيا والهندسة والرياضيات والعلوم الإنسانية.

Maksym Del, Markus Kängsepp, Marharyta Domnich, Ardi Tampuu, Lisa Yankovskaya, Meelis Kull, Mark Fishel2026-03-20
💬 NLP

UGID: Unified Graph Isomorphism for Debiasing Large Language Models

تقترح الورقة البحثية إطار عمل UGID، وهو إطار عمل موحد لتماثل الرسوم البيانية يعمل على إزالة التحيز من النماذج اللغوية الكبيرة من خلال فرض الثبات الهيكلي في رسومها البيانية الحسابية الداخلية عبر المدخلات المضادة للواقع، مما يقلل التحيز بفعالية مع الحفاظ على القدرات العامة والسلامة.

Zikang Ding, Junchi Yao, Junhao Li, Yi Zhang, Wenbo Jiang, Hongbo Liu, Lijie Hu2026-03-20
⚡ electrical engineering

How Auditory Knowledge in LLM Backbones Shapes Audio Language Models: A Holistic Evaluation

تتقصى هذه الورقة البحثية كيف تؤثر المعرفة السمعية التي اكتسبتها النماذج اللغوية الكبيرة المعتمدة على النصوص فقط أثناء مرحلة ما قبل التدريب على أدائها في النماذج اللغوية الصوتية الكبيرة، كاشفةً عن تباينات كبيرة عبر عائلات النماذج وعلاقة ارتباط قوية بين المعرفة السمعية القائمة على النصوص والقدرات الصوتية اللاحقة.

Ke-Han Lu, Szu-Wei Fu, Chao-Han Huck Yang, Zhehuai Chen, Sung-Feng Huang, Chih-Kai Yang, Yi-Cheng Lin, Chi-Yuan Hsiao, W (…)2026-03-20