💬 NLP

TelcoAgent-Bench: A Multilingual Benchmark for Telecom AI Agents

تقدم هذه الورقة TelcoAgent-Bench، وهو إطار عمل متعدد اللغات للتقييم المرجعي مصمم لتقييم موثوقية واتساق التشغيل لوكلاء النماذج اللغوية الكبيرة في مجال الاتصالات باللغتين الإنجليزية والعربية، كاشفاً أنه بينما تفهم النماذج الحالية مشكلات الاتصالات، إلا أنها تعاني من أجل التنفيذ المتسق لاستكشاف الأخطاء وإصلاحها والاستقرار عبر تنوع السيناريوهات.

Lina Bariah, Brahim Mefgouda, Farbod Tavakkoli, Enrique Molero, Louis Powell, Merouane Debbah2026-04-09
💻 computer science

Code Sharing In Prediction Model Research: A Scoping Review

تكشف هذه المراجعة النطاقية لما يقرب من 4,000 دراسة لنماذج التنبؤ أنه على الرغم من تزايد مشاركة الأكواد، إلا أنها لا تزال غير شائعة وغالباً ما تفتقر إلى التوثيق، وتحديد التبعيات، والبنية التركيبية اللازمة لتحقيق قابلية إعادة الإنتاج الحقيقية، مما يوفر أساساً تجريبياً لتطوير المبدأ التوجيهي لإبلاغ TRIPOD-Code.

Thomas Sounack, Raffaele Giancotti, Catherine A. Gao, Lasai Barreñada, Hyeonhoon Lee, Hyung-Chul Lee, Leo Anthony Celi (…)2026-04-09
💬 NLP

Blending Human and LLM Expertise to Detect Hallucinations and Omissions in Mental Health Chatbot Responses

تقترح هذه الورقة إطار عمل هجين يدمج الخبرة البشرية في المجال مع النماذج اللغوية الكبيرة لاستخراج سمات قابلة للتفسير للكشف عن الهلوسة والحذف في استجابات روبوتات الدردشة الخاصة بالصحة النفسية، مما يثبت أن هذا النهج يتفوق بشكل كبير على أساليب "النموذج اللغوي الكبير كحكم" (LLM-as-a-judge) الصندوقية السوداء في سياقات الرعاية الصحية عالية المخاطر.

Khizar Hussain, Bradley A. Malin, Zhijun Yin, Susannah Leigh Rose, Murat Kantarcioglu2026-04-09
💻 computer science

Automating Database-Native Function Code Synthesis with LLMs

تقدم الورقة البحثية نظام DBCooker، وهو نظام قائم على النماذج اللغوية الكبيرة (LLM) يعمل على أتمتة تخليق الدوال المعقدة الأصلية لقواعد البيانات من خلال بنية متخصصة ثلاثية المكونات تتضمن توصيف الدوال، وعمليات الترميز الهجينة، والتحقق متعدد المستويات، محققاً دقة أعلى بكثير من الطرق الحالية عبر أنظمة قواعد البيانات الرئيسية.

Wei Zhou, Xuanhe Zhou, Qikang He, Guoliang Li, Bingsheng He, Quanqing Xu, Fan Wu2026-04-09
💬 NLP

In-Context Learning in Speech Language Models: Analyzing the Role of Acoustic Features, Linguistic Structure, and Induction Heads

تتقصى هذه الورقة البحثية التعلم في السياق (In-Context Learning) في نماذج لغة الكلام من خلال إثبات أن معدل التحدث يؤثر بشكل كبير على كل من استنتاج المهام والمحاكاة الصوتية، مع بيان أن رؤوس الاستقراء (induction heads) تلعب دوراً سببياً في تمكين هذه القدرات، بشكل مشابه للنتائج التي تم التوصل إليها في النماذج القائمة على النصوص.

Charlotte Pouw, Hosein Mohebbi, Afra Alishahi, Willem Zuidema2026-04-09
💬 NLP

The Illusion of Superposition? A Principled Analysis of Latent Thinking in Language Models

تتقصى هذه الورقة ما إذا كانت النماذج اللغوية تستخدم التراكب (superposition) للحفاظ على مسارات استدلال متعددة في سلاسل الأفكار الكامنة، وتجد أن هذه القدرة لا تظهر إلا في النماذج المدربة من الصفر، بينما تفشل أنظمة التدريب بدون تدريب إضافي (training-free) والأنظمة التي خضعت للضبط الدقيق (fine-tuned) في الاستفادة من التراكب بسبب انحيازات ما قبل التدريب نحو الالتزام بالرموز (token commitment) وقيود السعة.

Michael Rizvi-Martel, Guillaume Rabusseau, Marius Mosbach2026-04-09
💬 NLP

Application-Driven Pedagogical Knowledge Optimization of Open-Source LLMs via Reinforcement Learning and Supervised Fine-Tuning

تقدم هذه الورقة البحثية EduQwen، وهي عائلة من النماذج اللغوية الكبيرة المفتوحة المصدر ذات الـ 32 مليار معلمة والمخصصة للأغراض التربوية، والتي تستفيد من استراتيجية تحسين مبتكرة متعددة المراحل تجمع بين التعلم التعزيزي والضبط الدقيق الخاضع للإشراف لتحقيق أداء رائد في المعايير التعليمية، متفوقةً بذلك بشكل كبير على الأنظمة المملوكة الأكبر حجماً مع الحفاظ على الشفافية وكفاءة التكلفة المطلوبة للنشر المسؤول للذكاء الاصطناي.

Navan Preet Singh, Xiaokun Wang, Anurag Garikipati, Madalina Ciobanu, Qingqing Mao, Ritankar Das2026-04-09
💬 NLP

FMI@SU ToxHabits: Evaluating LLMs Performance on Toxic Habit Extraction in Spanish Clinical Texts

تقدم هذه الورقة دراسة أجراها فريق FMI@SU قيمت استراتيجيات متنوعة لتلقين النماذج اللغوية الكبيرة لاستخراج وتصنيف ذكر العادات السامة (التبغ، والكحول، والقنب، والمخدرات) في النصوص السريرية الإسبانية، محققةً درجة F1 في مجموعة الاختبار بلغت 0.65 باستخدام تقنية التلقين بلقطات قليلة لنموذج GPT-4.1.

Sylvia Vassileva, Ivan Koychev, Svetla Boytcheva2026-04-09
💬 NLP

Say Something Else: Rethinking Contextual Privacy as Information Sufficiency

تعيد هذه الورقة تعريف الخصوصية السياقية لوكلاء النماذج اللغوية الكبيرة باعتبارها مهمة "كفاية معلومات"، مقدمةً إخفاء الهوية عبر النصوص الحرة كاستراتيجية متفوقة، وبروتوكول تقييم حواري يكشف كيف أن التقييمات القائمة على الرسالة الواحدة تستهين بتسرب الخصوصية مقارنة بالتفاعلات متعددة الأدوار.

Yunze Xiao, Wenkai Li, Xiaoyuan Wu, Ningshan Ma, Yueqi Song, Weihao Xuan2026-04-09
💬 NLP

Attention Flows: Tracing LLM Conceptual Engagement via Story Summaries

تقيم هذه الورقة قدرة النماذج اللغوية الكبيرة المتطورة على استيعاب السرديات الطويلة من خلال مقارنة ملخصاتها المبتكرة بتلك المكتوبة بشرياً، مما يكشف عن معاناة النماذج في التكامل الشمولي وتركيزها بشكل غير متناسب على نهايات النصوص، وهو اكتشاف مرتبط بآليات الانتباه لديها.

Rebecca M. M. Hicke, Sil Hamilton, David Mimno, Ross Deans Kristensen-McLachlan2026-04-09