💬 NLP

An Empirical Study of Many-Shot In-Context Learning for Machine Translation of Low-Resource Languages

تثبت هذه الورقة تجريبيًا أن التعلم داخل السياق متعدد الأمثلة (many-shot in-context learning) يحسن الترجمة الآلية للغات ذات الموارد المنخفضة بشكل كبير، حيث يوفر استرجاع الأمثلة القائم على خوارزمية BM25 مكاسب جوهرية في كفاءة البيانات من خلال مضاهاة أداء مجموعات أمثلة أكبر بكثير غير مسترجعة.

Yinhan Lu, Gaganpreet Jhajj, Chen Zhang, Anietie Andy, David Ifeoluwa Adelani2026-04-06
💬 NLP

Reinforcement Learning-based Knowledge Distillation with LLM-as-a-Judge

تقترح هذه الورقة إطار عمل للتعلم التعزيزي يستخدم نموذج لغة كبير (LLM) كحَكَمٍ أحادي الرمز لتوفير إشارات مكافأة فعالة وخالية من الملصقات لعملية تقطير المعرفة، مما يعزز قدرات الاستدلال بشكل كبير في الاختبارات المرجعية للرياضيات حتى عند دمجه مع مكافآت قابلة للتحقق.

Yiyang Shen, Lifu Tu, Weiran Wang2026-04-06
💬 NLP

Train Yourself as an LLM: Exploring Effects of AI Literacy on Persuasion via Role-playing LLM Training

تقدم هذه الورقة LLMimic، وهو درس تعليمي تفاعلي قائم على لعب الأدوار يقوم بتحويل عملية تدريب النماذج اللغوية الكبيرة إلى لعبة لتعزيز الثقافة الذكاء الاصطناعي، والتي أظهرت دراسة أجريت على 274 مشاركاً أنها تقلل بشكل كبير من القابلية للتأثر بالإقناع من قبل الذكاء الاصطناعي وتعزز الصدق والمسؤولية الاجتماعية.

Qihui Fan, Min Ge, Chenyan Jia, Weiyan Shi2026-04-06
💬 NLP

Revealing the Learning Dynamics of Long-Context Continual Pre-training

تقدم هذه الورقة أول استقصاء منهجي للتدريب المسبق المستمر طويل السياق على نموذج ذي درجة صناعية، كاشفةً أن التوسع الهائل في البيانات ضروري لتجنب الإنهاء المبكر، ومقترحةً إطار عمل هرمي باستخدام الحيرة (perplexity) وأنماط الانتباه للتغلب على قيود المعايير التقليدية مثل "الإبرة في كومة القش".

Yupu Liang, Shuang Chen, Guanwei Zhang, Shaolei Wang, Suncong Zheng2026-04-06
💬 NLP

Breakdowns in Conversational AI: Interactional Failures in Emotionally and Ethically Sensitive Contexts

تقدم هذه الورقة محاكياً للمستخدم مشروطاً بالشخصية لاختبار قدرة الذكاء الاصطناه التوليدي الحواري في السياقات الحساسة عاطفياً وأخلاقياً، مما يكشف عن انهيارات تفاعلية متكررة مثل عدم الاتساق الوجداني وإخفاقات التوجيه الأخلاقي، وتقترح تصنيفاً لتوجيه تصميم أنظمة حوارية أكثر تماسكاً وحساسية.

Jiawen Deng, Wentao Zhang, Ziyun Jiao, Fuji Ren2026-04-06
💬 NLP

IndustryCode: A Benchmark for Industry Code Generation

تقدم هذه الورقة IndustryCode، وهو أول معيار مرجعي شامل يمتد عبر مجالات صناعية ولغات برمجة متعددة لمعالجة أوجه القصور في التقييمات الحالية لتوليد الكود البرمجي في عكس التعقيد الصناعي الواقعي.

Puyu Zeng, Zhaoxi Wang, Zhixu Duan, Liang Feng, Shaobo Wang, Cunxiang Wang, Jinghang Wang, Bing Zhao, Hu Wei, Linfeng Zh (…)2026-04-06
💬 NLP

One Model to Translate Them All? A Journey to Mount Doom for Multilingual Model Merging

تتقصى هذه الورقة البحثية سبب فشل دمج نماذج فضاء الأوزان القياسية في الترجمة الآلية متعددة اللغات، كاشفةً أن الضبط الدقيق يعيد توزيع العصبونات الخاصة بكل لغة لزيادة التباعد التمثيلي في الطبقات العليا، مما يقوض التوافق الهندسي المطلوب لعملية الدمج الناجحة.

Baban Gain, Asif Ekbal, Trilok Nath Singh2026-04-06
💬 NLP

BioUNER: A Benchmark Dataset for Clinical Urdu Named Entity Recognition

تقدم هذه الورقة BioUNER، وهو مجموعة بيانات مرجعية معيارية لتعرّف الكيانات المسماة الطبية باللغة الأردية، تم إنشاؤها من 153 ألف رمز من النصوص الطبية مع اتفاق عالٍ بين المقيّمين، وتتحقق من فائدتها من خلال تقييم نماذج مختلفة من تعلم الآلة والتعلم العميق.

Wazir Ali, Adeeb Noor, Sanaullah Mahar, Alia, Muhammad Mazhar Younas2026-04-06
🤖 AI

Analysis of Optimality of Large Language Models on Planning Problems

تُثبت هذه الورقة أن النماذج اللغوية الكبيرة المعززة بالاستدلال تحقق مثالية شبه كاملة في مهام التخطيط المعقدة لـ "عالم الكتل" (Blocksworld) و"المسار-النجم" (Path-Star) عبر الاستفادة من المحاكاة الخوارزمية النشطة والذاكرة الهندسية، متفوقةً بشكل كبير على المخططات التقليدية التي تكتفي بتحقيق الحلول المرضية حتى عند تجريدها من الأوليات الدلالية.

Bernd Bohnet, Michael C. Mozer, Kevin Swersky, Wil Cunningham, Aaron Parisi, Kathleen Kenealy, Noah Fiedel2026-04-06
💬 NLP

Council Mode: Mitigating Hallucination and Bias in LLMs via Multi-Agent Consensus

تقدم هذه الورقة "وضع المجلس" (Council Mode)، وهو إطار عمل جديد للتوافق بين الوكلاء المتعددين يعمل على التخفيف من الهلوسة والتحيزات في النماذج اللغوية الكبيرة عبر توجيه الاستعلامات من خلال مصنف فرز، وتوليد استجابات متوازية من نماذج رائدة متنوعة، وتركيبها عبر آلية توافق مهيكلة، مما يؤدي إلى تحسينات كبيرة في الدقة الواقعية وتقليل تباين التحيز.

Shuai Wu, Xue Li, Yanna Feng, Yufang Li, Zhijun Wang2026-04-06