💬 NLP

The Rise of AfricaNLP: Contributions, Contributors, Community Impact, and Bibliometric Analysis

تقدم هذه الورقة تحليلاً ببليومترياً شاملاً لأبحاث معالجة اللغات الطبيعية في أفريقيا (AfricaNLP) من عام 2005 إلى عام 2025، وذلك باستخدام مجموعة بيانات مُعنونة يدوياً تضم 2,200 ورقة بحثية لقياس المساهمات، وتتبع الاتجاهات، وتحديد الباحثين والمؤسسات الرئيسيين من خلال أداة مستكشف الأبحاث المطورة حديثاً.

Tadesse Destaw Belay, Kedir Yassin Hussen, Sukairaj Hafiz Imam, Ibrahim Said Ahmad, Isa Inuwa-Dutse, Abrham Belete Haile (…)2026-03-31
💬 NLP

Agentic Context Engineering: Evolving Contexts for Self-Improving Language Models

تقدم الورقة البحثية "هندسة السياق الوكيلية" (ACE)، وهو إطار عمل يعامل السياقات ككتيبات تعليمات متطورة للتغلب على انحياز الإيجاز وانهيار السياق، مما يمكّن النماذج اللغوية ذاتية التحسين من تحقيق أداء رائد في الاختبارات المعيارية للوكلاء والمجالات المتخصصة من خلال تحديثات هيكلية وتزايدية دون الحاجة إلى إشراف مصنف.

Qizheng Zhang, Changran Hu, Shubhangi Upasani, Boyuan Ma, Fenglu Hong, Vamsidhar Kamanuru, Jay Rainton, Chen Wu, Mengmen (…)2026-03-31
💬 NLP

CLMN: Concept based Language Models via Neural Symbolic Reasoning

تقدم الورقة البحثية CLMN، وهو إطار عمل عصبي-رمزي يعزز قابلية التفسير والأداء في معالجة اللغات الطبيعية من خلال تمثيل المفاهيم كتضمينات مستمرة وتطبيق منطق ضبابي للاستدلال لنمذجة التفاعلات الديناميكية واستنباط قواعد منطقية شفافة.

Yibo Yang2026-03-31
💬 NLP

Schema for In-Context Learning

مستلهماً من نظرية المخططات المعرفية، تقدم الورقة البحثية "التعلم داخل السياق المنشط بالمخططات" (SA-ICL)، وهو إطار عمل يعمل على بناء قوالب استدلال مجردة من الأمثلة السابقة بشكل صريح لتعزيز أداء النماذج اللغوية الكبيرة في المهام العلمية المعقدة وقابليتها للتفسير بشكل كبير، مع تقليل الاعتماد على أمثلة توضيحية عديدة.

Pan Chen, Shaohong Chen, Mark Wang, Shi Xuan Leong, Priscilla Fung, Varinia Bernales, Alan Aspuru-Guzik2026-03-31
💬 NLP

Evaluating Latent Knowledge of Public Tabular Datasets in Large Language Models

تقترح هذه الورقة إطار عمل جديداً يستخدم تحويلات الاستعلام المُتحكم بها والاختبار الإحصائي للكشف عن تلوث البيانات في النماذج اللغوية الكبيرة على مجموعات البيانات الجدولية، مما يكشف أن الأداء في أربعة من أصل ثمانية مجموعات بيانات مستخدمة على نطاق واسع من المرجح أنه متضخم بسبب التعرض المسبق بدلاً من التعميم الحقيقي.

Matteo Silvestri, Fabiano Veglianti, Flavio Giorgi, Fabrizio Silvestri, Gabriele Tolomei2026-03-31
💬 NLP

LuxIT: A Luxembourgish Instruction Tuning Dataset from Monolingual Seed Data

تقدم هذه الورقة LuxIT، وهي مجموعة بيانات عالية الجودة لضبط التعليمات أحادية اللغة للغة اللوكسمبورغية تم استخلاصها من نصوص أصلية والتحقق من صحتها عبر نموذج لغوي كبير كحكم (LLM-as-a-judge)، مما يثبت أن ضبط النماذج الأصغر حجماً على هذه البيانات يحسن بشكل كبير أداءها في امتحانات كفاءة اللغة ومختلف مهام معالجة اللغات الطبيعية اللاحقة.

Julian Valline, Cedric Lothritz, Siwen Guo, Jordi Cabot2026-03-31
💬 NLP

Complete asymptotic type-token relationship for growing complex systems with inverse power-law count rankings

تقدم هذه الورقة نموذجاً مثالياً حتمياً يستنبط تعبيراً تقاربياً موحداً للعلاقة بين النوع والرمز في الأنظمة المعقدة المتنامية، مبرهنةً على أن قانون "هيبس" ينبثق حصرياً كعاقبة رياضية لقانون "زيبف" عبر جميع أسس القوة دون الاعتماد على آليات عشوائية.

Pablo Rosillo-Rodes, Laurent Hébert-Dufresne, Peter Sheridan Dodds2026-03-31
💬 NLP

POTSA: A Cross-Lingual Speech Alignment Framework for Speech-to-Text Translation

تقدم الورقة البحثية POTSA، وهو إطار عمل مبتكر يستفيد من أزواج الكلام المتوازية والنقل الأمثل مع تعويض الانحياز وجدولة الطبقات لسد الفجوات بين موارد الترجمة الكلامية إلى نصية عالية ومنخفضة الموارد، محققاً أداءً هو الأفضل في فئته على معيار FLEURS بأقل قدر من البيانات المتوازية.

Xuanchen Li, Chenrui Cui, Tianrui Wang, Meng Ge, Zikang Huang, Jin Li, Yizhou Peng, Yuheng Lu, Nyima Tashi, Longbiao Wan (…)2026-03-31
💬 NLP

Beyond Elicitation: Provision-based Prompt Optimization for Knowledge-Intensive Tasks

تقدم هذه الورقة البحثية إطار عمل "تحسين التلقين القائم على توفير المعرفة" (KPPO)، الذي ينتقل من استراتيجيات الاستدلال إلى التكامل المنهجي للمعرفة، محققاً أداءً فائقاً في المهام كثيفة المعرفة مع تقليل استهلاك الرموز (tokens) بشكل كبير من خلال آليات مثل ملء الفجوات المعرفية، والتقييم بالدفعات، والتقليم التكيفي.

Yunzhe Xu, Zhuosheng Zhang, Zhe Liu2026-03-31
💬 NLP

π\pi-Attention: Periodic Sparse Transformers for Efficient Long-Context Modeling

تقدم الورقة البحثية π\pi-Attention، وهي بنية Transformer دورية متفرقة تجمع بين الجوارات المحلية، والقفزات الخطوية الحتمية، والدمج التكيفي لتحقيق تعقيد خطي وأداء فائق في نمذجة السياق الطويل مع تقليل الموارد الحسابية بشكل كبير مقارنة بالطرق الحالية مثل RingAttention.

Dong Liu, Yanxuan Yu2026-03-31