💬 NLP

The Stepwise Informativeness Assumption: Why are Entropy Dynamics and Reasoning Correlated in LLMs?

تقترح هذه الورقة البحثية وتثبت تجريبياً "فرضية المعلوماتية التدريجية"، التي تفسر الارتباط بين ديناميكيات الإنتروبيا الداخلية وصحة الاستدلال في النماذج اللغوية الكبيرة من خلال إثبات أن مسارات الاستدلال الصحيحة تراكم المعلومات ذات الصلة بالإجابة في التوقع عبر تدريب الاحتمال الأقصى والتعلم المعزز.

Mar Gonzàlez I Català, Haitz Sáez de Ocáriz Borde, George D. Montañez, Pietro Liò2026-04-09
💬 NLP

Depression Detection at the Point of Care: Automated Analysis of Linguistic Signals from Routine Primary Care Encounters

تُظهر هذه الدراسة أن التحليل الآلي للإشارات اللغوية المستمدة من التسجيلات الصوتية الروتينية في الرعاية الأولية، لا سيما باستخدام نماذج GPT ذات التعلم الصفري والنصوص المنسوخة الثنائية، يمكن أن يكتشف الاكتئاب بفعالية لدعم اتخاذ القرارات السريرية في الوقت المناسب.

Feng Chen, Manas Bedmutha, Janice Sabin, Andrea Hartzler, Nadir Weibel, Trevor Cohen2026-04-09
💬 NLP

Hallucination as output-boundary misclassification: a composite abstention architecture for language models

تقترح هذه الورقة بنية امتناع مركبة تجمع بين الرفض القائم على التعليمات وآلية بوابية هيكلية — باستخدام الاتساق الذاتي، واستقرار إعادة الصياغة، وتغطية الاستشهاد للكشف عن الادعاءات غير المدعومة — للحد من الهلوسة في النماذج اللغوية الكبيرة بفعالية من خلال الاستفادة من نقاط القوة المتكاملة لكلا النهجين.

Angelina Hintsanen2026-04-09
💬 NLP

Emergent decentralized regulation in a purely synthetic society

تُثبت هذه الورقة أن مجتمعاً اصطناعياً بحتاً من وكلاء الذكاء الاصطناعي المستقلين على شبكة "مولتبوك" (Moltbook) يُظهر تنظيماً ذاتياً ناشئاً وداخلياً، حيث تزدዛد احتمالية تلقي تغذية راجعة تصحيحية من الوكلاء الآخرين بشكل يتناسب طردياً مع شدة اللغة التوجيهية في منشوراتهم.

Md Motaleb Hossen Manik, Ge Wang2026-04-09
💬 NLP

Beyond Facts: Benchmarking Distributional Reading Comprehension in Large Language Models

تقدم الورقة البحثية Text2DistBench، وهو معيار تقييم مؤتمت ومحدث باستمرار يستخدم تعليقات يوتيوب من العالم الحقيقي لتقييم قدرة النماذج اللغوية الكبيرة على استنتاج المعرفة التوزيعية، مثل نسب المشاعر وتكرارات المواضيع، مما يكشف عن تباينات كبيرة في الأداء عبر أنواع التوزيع المختلفة.

Pei-Fu Guo, Ya-An Tsai, Chun-Chia Hsu, Kai-Xin Chen, Yun-Da Tsai, Kai-Wei Chang, Nanyun Peng, Mi-Yen Yeh, Shou-De Lin2026-04-09
💬 NLP

Cross-Lingual Transfer and Parameter-Efficient Adaptation in the Turkic Language Family: A Theoretical Framework for Low-Resource Language Models

تقترح هذه الورقة إطاراً نظرياً لتحسين النقل عبر اللغات والتكيف الفعال للمعلمات للنماذج اللغوية الكبيرة ضمن عائلة اللغات التركية من خلال تقديم معامل النقل التركي (TTC) ونموذج قياس مفاهيمي لتحليل كيفية تأثير التشابهات النمطية وتفاوت الموارد على أداء التكيف عبر اللغات الأذربيجانية والكازاخستانية والأوزبكية والتركمانية والغاغوزية.

O. Ibrahimzade, K. Tabasaransky2026-04-09
💬 NLP

Extracting Breast Cancer Phenotypes from Clinical Notes: Comparing LLMs with Classical Ontology Methods

تقدم هذه الورقة إطار عمل يعتمد على النماذج اللغوية الكبيرة لاستخراج الأنماط الظاهرية لسرطان الثدي من الملاحظات السريرية غير المهيكلة، مما يثبت تحقيقها دقة تضاهي الطرق التقليدية القائمة على الوجودية (ontology) مع تقديم قدرة أكبر على التكيف مع أمراض أخرى.

Abdullah Bin Faiz, Arbaz Khan Shehzad, Asad Afzal, Momin Tariq, Muhammad Siddiqi, Muhammad Usamah Shahid, Maryam Noor Aw (…)2026-04-09
💬 NLP

TelcoAgent-Bench: A Multilingual Benchmark for Telecom AI Agents

تقدم هذه الورقة TelcoAgent-Bench، وهو إطار عمل متعدد اللغات للتقييم المرجعي مصمم لتقييم موثوقية واتساق التشغيل لوكلاء النماذج اللغوية الكبيرة في مجال الاتصالات باللغتين الإنجليزية والعربية، كاشفاً أنه بينما تفهم النماذج الحالية مشكلات الاتصالات، إلا أنها تعاني من أجل التنفيذ المتسق لاستكشاف الأخطاء وإصلاحها والاستقرار عبر تنوع السيناريوهات.

Lina Bariah, Brahim Mefgouda, Farbod Tavakkoli, Enrique Molero, Louis Powell, Merouane Debbah2026-04-09
💻 computer science

Code Sharing In Prediction Model Research: A Scoping Review

تكشف هذه المراجعة النطاقية لما يقرب من 4,000 دراسة لنماذج التنبؤ أنه على الرغم من تزايد مشاركة الأكواد، إلا أنها لا تزال غير شائعة وغالباً ما تفتقر إلى التوثيق، وتحديد التبعيات، والبنية التركيبية اللازمة لتحقيق قابلية إعادة الإنتاج الحقيقية، مما يوفر أساساً تجريبياً لتطوير المبدأ التوجيهي لإبلاغ TRIPOD-Code.

Thomas Sounack, Raffaele Giancotti, Catherine A. Gao, Lasai Barreñada, Hyeonhoon Lee, Hyung-Chul Lee, Leo Anthony Celi (…)2026-04-09
💬 NLP

Blending Human and LLM Expertise to Detect Hallucinations and Omissions in Mental Health Chatbot Responses

تقترح هذه الورقة إطار عمل هجين يدمج الخبرة البشرية في المجال مع النماذج اللغوية الكبيرة لاستخراج سمات قابلة للتفسير للكشف عن الهلوسة والحذف في استجابات روبوتات الدردشة الخاصة بالصحة النفسية، مما يثبت أن هذا النهج يتفوق بشكل كبير على أساليب "النموذج اللغوي الكبير كحكم" (LLM-as-a-judge) الصندوقية السوداء في سياقات الرعاية الصحية عالية المخاطر.

Khizar Hussain, Bradley A. Malin, Zhijun Yin, Susannah Leigh Rose, Murat Kantarcioglu2026-04-09