💬 NLP

ClimateCheck 2026: Scientific Fact-Checking and Disinformation Narrative Classification of Climate-related Claims

تُعد ClimateCheck 2026 مهمة مشتركة تعمل على تطوير التحقق الآلي من الادعاءات المتعلقة بالمناخ وتصنيف روايات التضليل الإعلامي من خلال مجموعات بيانات موسعة، وأطر تقييم مبتكرة تعالج انحيازات التوسيم، ورؤى حول تباين قابلية التحقق من أنواع مختلفة من المعلومات المضللة بشأن المناخ.

Raia Abu Ahmad, Max Upravitelev, Aida Usmanova, Veronika Solopova, Georg Rehm2026-03-30
⚛️ quantum physics

Entanglement as Memory: Mechanistic Interpretability of Quantum Language Models

تقدم هذه الدراسة أول إطار عمل للتفسير الآلي للنماذج اللغوية الكمومية، كاشفةً أنه في حين يمكن للنماذج ذات الكيوبت المزدوج تعلم استراتيجية ذاكرة متميزة قائمة على التشابك، فإن هذا النهج يتسم بالهشاشة وينهار تحت تأثير ضجيج الأجهزة في العالم الحقيقي، بينما تعود النماذج ذات الكيوبت الواحد إلى استراتيجيات يمكن محاكاتها كلاسيكياً.

Nathan Roll2026-03-30
💬 NLP

Clinical named entity recognition in the Portuguese language: a benchmark of modern BERT models and LLMs

تقوم هذه الدراسة بقياس أداء نماذج متنوعة من فئة BERT والنماذج اللغوية الكبيرة في مجال التعرف على الكيانات السريرية باللغة البرتغالية، حيث تُظهر أن نموذج mmBERT-base يحقق أعلى أداء (micro F1 = 0.76) على مجموعات البيانات العامة والخاصة، لا سيما عند دمجه مع التدرج التكراري لمعالجة عدم توازن الفئات.

Vinicius Anjos de Almeida, Sandro Saorin da Silva, Josimar Chire, Leonardo Vicenzi, Nícolas Henrique Borges, Helena Koci (…)2026-03-30
💬 NLP

AMALIA Technical Report: A Fully Open Source Large Language Model for European Portuguese

تقدم الورقة البحثية AMALIA، وهو نموذج لغوي كبير مفتوح المصدر بالكامل ومُحسَّن للغة البرتغالية الأوروبية من خلال تدريب مستهدف على بيانات عالية الجودة ومجموعة جديدة من الاختبارات المعيارية الأصلية، مما يثبت أن مثل هذه النهج المركزة تتفوق بشكل كبير على النماذج القياسية في المهام الخاصة بالمتغيرات اللغوية.

Afonso Simplício, Gonçalo Vinagre, Miguel Moura Ramos, Diogo Tavares, Rafael Ferreira, Giuseppe Attanasio, Duarte M. Alv (…)2026-03-30
💬 NLP

ALBA: A European Portuguese Benchmark for Evaluating Language and Linguistic Dimensions in Generative LLMs

تقدم هذه الورقة ALBA، وهو معيار مرجعي تم بناؤه يدويًا ومستند إلى أسس لغوية، صُمم لتقييم أداء النماذج اللغوية الكبيرة في ثمانية أبعاد لغوية محددة في اللغة البرتغالية الأوروبية، وذلك لمعالجة النقص الحالي في الموارد لهذا النوع اللغوي غير الممثل كفاية.

Inês Vieira, Inês Calvo, Iago Paulo, James Furtado, Rafael Ferreira, Diogo Tavares, Diogo Glória-Silva, David Semedo, Jo (…)2026-03-30
🧬 biology

Development of a European Union Time-Indexed Reference Dataset for Assessing the Performance of Signal Detection Methods in Pharmacovigilance using a Large Language Model

تعالج هذه الدراسة فجوة حرجة في اليقظة الدوائية من خلال تطوير مجموعة بيانات مرجعية جديدة ذات مؤشر زمني للاتحاد الأوروبي، مستمدة من 1,513 منتجاً طبياً مرخصاً مركزياً ومعالجة باستخدام DeepSeek V3، والتي تدمج التوقيت الدقيق للتعرف على الأعراض الجانبية لتمكين تقييم ومقارنة أكثر دقة لطرق الكشف عن الإشارات.

Maria Kefala, Jeffery L. Painter, Syed Tauhid Bukhari, Maurizio Sessa2026-03-30
💬 NLP

PerceptionComp: A Video Benchmark for Complex Perception-Centric Reasoning

تقدم الورقة البحثية PerceptionComp، وهو معيار مرجعي مُصنف يدويًا يضم 1,114 سؤالاً معقدًا عبر 279 فيديو متنوعًا تتطلب استدلالًا إدراكيًا متعدد الخطوات وطويل المدى، مما يكشف أن النماذج الحالية المتطورة وحتى البشر يعانون بشكل كبير مع المهام التي تتطلب منطقًا تركيبيًا وأدلة بصرية متكررة.

Shaoxuan Li, Zhixuan Zhao, Hanze Deng, Zirun Ma, Shulin Tian, Zuyan Liu, Yushi Hu, Haoning Wu, Yuhao Dong, Benlin Liu, Z (…)2026-03-30
💬 NLP

Learning to Commit: Generating Organic Pull Requests via Online Repository Memory

تقدم الورقة البحثية إطار عمل "التعلم من أجل الالتزام" (Learning to Commit)، الذي يعزز عضوية طلبات السحب (pull requests) المُولدة بواسطة النماذج اللغوية الكبيرة عبر تدريب الوكلاء على التزامات المستودعات التاريخية من خلال نظام ذاكرة مستودع عبر الإنترنت، مما يمكنهم من تعلم الاصطلاحات الخاصة بالمشروع والأنماط المعمارية لإنتاج كود يتوافق مع توقعات القائمين على الصيانة في العالم الحقيقي.

Mo Li, L. H. Xu, Qitai Tan, Ting Cao, Yunxin Liu2026-03-30
💬 NLP

CodeRefine: A Pipeline for Enhancing LLM-Generated Code Implementations of Research Papers

يُعد CodeRefine إطار عمل مبتكرًا يسد الفجوة بين البحث النظري والتنفيذ العملي من خلال استخدام النماذج اللغوية الكبيرة لاستخراج المنهجيات الرئيسية، وبناء رسم بياني معرفي، وتوليد كود مُحسَّن عبر نهج استرجاع معزز بالتوليد استعادي، مما يجعله يتفوق على أسلوب التلقين الصفري القياسي.

Ekaterina Trofimova, Emil Sataev, Abhijit Singh Jowhari2026-03-27
💬 NLP

LLMs know their vulnerabilities: Uncover Safety Gaps through Natural Distribution Shifts

تقدم هذه الورقة البحثية "ActorBreaker"، وهي طريقة هجوم مبتكرة قائمة على نظرية شبكة الفاعل تستغل تحولات التوزيع الطبيعي لتجاوز آليات السلامة في النماذج اللغوية الكبيرة عبر مطالبات متعددة الأدوار، وتقترح مجموعة بيانات سلامة متعددة الأدوار لتعزيز متانة النموذج ضد مثل هذه الثغرات.

Qibing Ren, Hao Li, Dongrui Liu, Zhanxu Xie, Xiaoya Lu, Yu Qiao, Lei Sha, Junchi Yan, Lizhuang Ma, Jing Shao2026-03-27