💬 NLP

MADE: A Living Benchmark for Multi-Label Text Classification with Uncertainty Quantification of Medical Device Adverse Events

تقدم هذه الورقة MADE، وهو معيار مرجعي "حي" يتم تحديثه باستمرار لتصنيف النصوص متعددة التسميات للأحداث الضائرة للأجهزة الطبية، والذي يعالج مشكلات تلوث البيانات وتعقيد التسميات مع توفير تقييم شامل لأداء النماذج وتقدير عدم اليقين عبر بنيات متنوعة.

Raunak Agarwal, Markus Wenzel, Simon Baur, Jonas Zimmer, George Harvey, Jackie Ma2026-04-17
🤖 AI

Learning to Think Like a Cartoon Captionist: Incongruity-Resolution Supervision for Multimodal Humor Understanding

تقدم هذه الورقة البحثية إطار عمل IRS (الإشراف على عدم الاتساق والحل)، وهو إطار يحسن فهم الفكاهة متعدد الوسائط من خلال الإشراف الصريح على عملية الاستدلال المهيكلة لتحديد عدم التطابق البصري وحله، مما يتفوق على النماذج المرجعية الحالية في مسابقة "نيويوركر" لكتابة التعليقات على الرسوم الكاريكاتورية ويثبت أن الإشراف على بنية الاستدلال أكثر أهمية من حجم النموذج وحده.

Hatice Merve Vural, Doga Kukul, Ege Erdem Ozlu, Demir Ekin Arikan, Bob Mankoff, Erkut Erdem, Aykut Erdem2026-04-17
💬 NLP

Deep Learning Based Amharic Chatbot for FAQs in Universities

تقدم هذه الورقة بحثاً حول روبوت دردشة باللغة الأمهرية يعتمد على التعلم العميق، يستخدم تقنيات معالجة اللغات الطبيعية ونموذج شبكة عصبية حقق دقة بنسبة 91.55% للإجابة بفعالية على الأسئلة الشائعة في الجامعات، مع معالجة التحديات اللغوية مثل التباين الصرفي والفجوات المعجمية، ويتم نشره عبر فيسبوك ماسنجر لضمان إمكانية الوصول على مدار 24 ساعة.

Goitom Ybrah Hailu, Hadush Hailu, Shishay Welay2026-04-16
💬 NLP

TableMaster: A Recipe to Advance Table Understanding with Language Models

تقدم الورقة البحثية TableMaster، وهو إطار عمل شامل يعزز فهم النماذج اللغوية للجداول من خلال معالجة التحديات الرئيسية عبر استخراج المحتوى، والإثراء الدلالي، والاستدلال التكيفي، محققاً أداءً هو الأفضل في فئته على مجموعة بيانات WikiTQ.

Lang Cao, Hanbing Liu2026-04-16
💬 NLP

A closer look at how large language models trust humans: patterns and biases

من خلال 43,200 تجربة محاكاة عبر خمسة نماذج وسيناريوهات، تكشف هذه الدراسة أنه بينما تطور الوكلاء القائمون على النماذج اللغوية الكبيرة عموماً ثقة في البشر بناءً على الكفاءة والنزاهة وحسن النية بشكل مشابه للأنماط البشرية، فإنهم يظهرون أيضاً تحيزات ديموغرافية كبيرة فيما يتعلق بالعمر والدين والجنس، لا سيما في السياقات المالية.

Valeria Lerman, Yaniv Dover2026-04-16
💬 NLP

Two-Stage Regularization-Based Structured Pruning for LLMs

تقدم هذه الورقة البحثية TRSP، وهي طريقة مبتكرة للتقليم الهيكلي القائم على التنظيم من مرحلتين، تعمل على تعلم أوزان الطبقات بشكل تكراري وتشجع على نقل المعرفة إلى الطبقات المحفوظة، مما يتيح نشر النماذج اللغوية الكبيرة بكفاءة مع احتفاظ فائق بالأداء وتسريع شامل من البداية إلى النهاية دون الحاجة إلى إعادة تدريب مكثفة.

Mingkuan Feng, Jinyang Wu, Siyuan Liu, Shuai Zhang, Ruihan Jin, Feihu Che, Pengpeng Shao, Zhengqi Wen, Jianhua Tao2026-04-16
💬 NLP

Bridging Compositional and Distributional Semantics: A Survey on Latent Semantic Geometry via AutoEncoder

يستكشف هذا الاستطلاع كيفية دمج الخصائص التركيبية والرمزية في الفضاءات الدلالية التوزيعية عبر المشفرات التلقائية التباينية، والمكممة المتجهة، والمتناثرة، وذلك لسد الفجوة بين الدلالات الرمزية والتوزيعية، مما يعزز من قابلية التفسير، والتحكم، والتعميم للنماذج اللغوية القائمة على المحولات.

Yingji Zhang, Danilo S. Carvalho, André Freitas2026-04-16
💬 NLP

LLMEval-Fair: A Large-Scale Longitudinal Study on Robust and Fair Evaluation of Large Language Models

يُعد LLMEval-Fair إطار تقييم ديناميكي يستخدم بنكًا خاصًا يضم ٢٢٠ ألف سؤال بمستوى الدراسات العليا، ومسار عمل آلي مقاوم للتلوث، لتوفير تقييمات قوية وعادلة وطولية للنماذج اللغوية الكبيرة تتجاوز قيود المعايير المرجعية الثابتة.

Ming Zhang, Yujiong Shen, Jingyi Deng, Yuhui Wang, Huayu Sha, Kexin Tan, Qiyuan Peng, Yue Zhang, Junzhe Wang, Shichun Li (…)2026-04-16
💬 NLP

RadAgents: Multimodal Agentic Reasoning for Chest X-ray Interpretation with Radiologist-like Workflows

يُعد RadAgents إطار عمل جديداً متعدد الوكلاء يعزز تفسير صور الأشعة السينية للصدر من خلال دمج الأوليات السريرية، والاستدلال متعدد الوسائط المدرك للمهام، وآليات التأسيس لمحاكاة سير عمل أخصائي الأشعة، مما ينتج مخرجات تشخيصية متوافقة سريرياً، ومؤسسة بصرياً، وقابلة للتحقق.

Kai Zhang, Corey D Barrett, Jangwon Kim, Lichao Sun, Tara Taghavi, Krishnaram Kenthapadi2026-04-16
💬 NLP

Native Hybrid Attention for Efficient Sequence Modeling

تقدم هذه الورقة البحثية آلية "الانتباه الهجين الأصيل" (Native Hybrid Attention - NHA)، وهي بنية موحدة تجمع بين السياق طويل الأمد القائم على الشبكات العصبية المتكررة الخطية (linear RNN) وبين الرموز قصيرة الأمد ذات النافذة المنزلقة، لتحقيق نمذجة تسلسلية فعالة وعالية الدقة تتفوق على نماذج "ترانسفورمر" (Transformers) القياسية والنماذج الهجينة المرجعية في المهام التي تعتمد بكثافة على الاستدعاء.

Jusen Du, Jiaxi Hu, Tao Zhang, Weigao Sun, Yu Cheng2026-04-16