💬 NLP

Interpreto: An Explainability Library for Transformers

تُعد Interpreto مكتبة مفتوحة المصدر بلغة بايثون توحد بين أساليب الإسناد والأساليب القائمة على المفاهيم لنماذج لغة HuggingFace، حيث تقدم مساراً مميزاً ومتكاملاً لتعلم المفاهيم والتفسير يربط بين الأبحاث الحديثة والأدوات العملية.

Antonin Poché, Thomas Mullor, Gabriele Sarti, Frédéric Boisnard, Corentin Friedrich, Charlotte Claye, François Hoofd, Ra (…)2026-02-24
💬 NLP

Where Did This Sentence Come From? Tracing Provenance in LLM Reasoning Distillation

تقدم هذه الورقة إطار عمل لتتبع أصل استخلاص الاستدلال (Reasoning Distillation Provenance Tracing) لتحليل أصول أفعال النموذج المستخلص من خلال مقارنة الاحتمالات التنبؤية عبر النماذج المعلمة والطالب والمستخلصة، مما يثبت أن الأفعال ذات الأصل المعلمي ترتبط بالأداء وتُمكّن من طريقة اختيار بيانات مبدئية موجهة بالمعلم لتحسين استخلاص الاستدلال.

Kaiyuan Liu, Shaotian Yan, Rui Miao, Bing Wang, Chen Shen, Jun Zhang, Jieping Ye2026-02-24
💬 NLP

Fast-weight Product Key Memory

تقدم الورقة البحثية ذاكرة مفتاح المنتج سريعة الأوزان (FwPKM)، وهي طبقة ذاكرة متفرقة تعالج المقايضة بين سعة التخزين والكفاءة الحسابية من خلال إجراء تحديثات تدرج وقت الاختبار على الفتحات المفعلة، مما يتيح حفظ واسترجاع السياق الطويل بفعالية مع حساب ثابت لكل رمز.

Tianyu Zhao, Llion Jones2026-02-24
💬 NLP

STaRR: Spatial-Temporal Token-Dynamics-Aware Responsive Remasking for Diffusion Language Models

تقترح الورقة البحثية إطار عمل STaRR، وهو إطار عمل لا يتطلب تدريباً يعمل على تحسين سرعة الاستدلال وجودة نماذج اللغات الانتشارية من خلال التكيف ديناميكياً مع قرارات إعادة قناع الرموز بناءً على ديناميكيات الثقة المكانية والزمانية، محققاً تسريعاً كبيراً دون المساس بالدقة.

Xinhao Sun, Huaijin Zhao, Maoliang Li, Zihao Zheng, Jiayu Chen, Yun Liang, Xiang Chen2026-02-24
💬 NLP

APEX-Agents

تقدم الورقة البحثية APEX-Agents، وهو معيار مفتوح المصدر وبنية تحتية للتقييم مصممة لتقدير قدرات الوكلاء الذكيين في تنفيذ مهام معقدة، طويلة الأمد، ومتعددة التطبيقات نموذجية في مجالات الاستثمار المصرفي، والاستشارات الإدارية، والأعمال القانونية، كاشفةً أن أفضل النماذج الحالية تحقق أقصى درجة Pass@1 تبلغ 24.0%.

Bertie Vidgen, Austin Mann, Abby Fennelly, John Wright Stanly, Lucas Rothman, Marco Burstein, Julien Benchek, David Ostr (…)2026-02-24
💬 NLP

EBPO: Empirical Bayes Shrinkage for Stabilizing Group-Relative Policy Optimization

تقترح الورقة البحثية إطار عمل EBPO، وهو إطار عمل مبتكر يعمل على تثبيت عملية تحسين السياسة النسبية للمجموعات (GRPO) للنماذج اللغوية الكبيرة من خلال توظيف تقليص بايز التجريبي (Empirical Bayes shrinkage) لتنظيم خطوط الأساس المحلية باستخدام الإحصاءات العالمية، مما يؤدي إلى تقليل تباين المُقدِّر، ومنع تلاشي التدرجات، والتفوق على الأساليب الحالية عبر مختلف معايير اختبار الاستدلال.

Kevin Han, Yuhang Zhou, Mingze Gao, Gedi Zhou, Serena Li, Abhishek Kumar, Xiangjun Fan, Weiwei Li, Lizhu Zhang2026-02-24
💬 NLP

Transport and Merge: Cross-Architecture Merging for Large Language Models

تقترح هذه الورقة إطار عمل للدمج عبر البنيات يعتمد على النقل الأمثل الذي يعمل على محاذاة التنشيطات لاستنتاج المراسلات بين النماذج غير المتجانسة، مما يتيح نقلاً فعالاً للمعرفة من النماذج اللغوية الكبيرة ذات الموارد العالية إلى النماذج الأصغر ذات الموارد المنخفضة من خلال دمج مباشر في فضاء الأوزان.

Chenhang Cui, Binyun Yang, Fei Shen, Yuxin Chen, Jingnan Zheng, Xiang Wang, An Zhang, Tat-Seng Chua2026-02-24
💬 NLP

G2CP: A Graph-Grounded Communication Protocol for Verifiable and Efficient Multi-Agent Reasoning

يقدم G2CP بروتوكول اتصال مرتكزاً على الرسوم البيانية يستبدل اللغة الطبيعية بعمليات رسوم بيانية مهيكلة للأنظمة متعددة الوكلاء، مما يقلل بشكل كبير من استهلاك الرموز (tokens) والهلوسة مع تحسين دقة الاستدلال والقابلية للتحقق في المهام الصناعية المعقدة.

Karim Ben Khaled, Davy Monticolo2026-02-24
💬 NLP

ADAB: Arabic Dataset for Automated Politeness Benchmarking -- A Large-Scale Resource for Computational Sociopragmatics

تقدم هذه الورقة البحثية ADAB، وهي مجموعة بيانات عربية موسومة واسعة النطاق تضم 10,000 عينة من منصات ولهجات متنوعة عبر الإنترنت، صُممت لتعزيز التداولية الاجتماعية الحاسوبية من خلال توفير معيار مرجعي للكشف عن اللباقة عبر فئات اللباقة، وعدم اللباقة، والحياد.

Hend Al-Khalifa, Nadia Ghezaiel, Maria Bounnit, Hend Hamed Alhazmi, Noof Abdullah Alfear, Reem Fahad Alqifari, Ameera Ma (…)2026-02-24
💬 NLP

RFEval: Benchmarking Reasoning Faithfulness under Counterfactual Reasoning Intervention in Large Reasoning Models

تقدم هذه الورقة RFEval، وهو معيار وإطار عمل رسمي لتقييم أمانة الاستدلال في نماذج الاستدلال اللغوية الكبيرة من خلال التدخلات الواقعية المضادة، كاشفةً أن ما يقرب من نصف مخرجات النماذج غير أمينة بسبب عدم اتساق المواقف، وأن الدقة تعد مؤشراً ضعيفاً للسلامة الهيكلية لعملية الاستدلال.

Yunseok Han, Yejoon Lee, Jaeyoung Do2026-02-24