💬 NLP

Augmenting Lateral Thinking in Language Models with Humor and Riddle Data for the BRAINTEASER Task

تقدم هذه الورقة نظاماً يعزز أداء نموذج DeBERTaV3 في مهمة SemEval 2024 BRAINTEASER من خلال ضبطه بدقة باستخدام بيانات الفكاهة والألغاز لتحسين التفكير الجانبي، مما يثبت أن هذا التعزيز يرفع الدقة بشكل كبير في ألغاز الجمل، وأن صياغة المهمة كاختيار من متعدد تحقق مكاسب جوهرية مقارنة بتصنيف المتواليات.

Mina Ghashami, Soumya Smruti Mishra2026-02-25
💬 NLP

Causal Claims in Economics

تقدم هذه الورقة رسومًا بيانية للادعاءات مشروحة بالأدلة لرسم العلاقات السببية وغير السببية عبر 44,852 ورقة بحثية في مجال الاقتصاد من عام 1980 إلى عام 2023، مما يكشف عن ارتفاع كبير في الادعاءات السببية بمرور الوقت ويثبت أن الأوراق البحثية ذات البنى السردية السببية الأكثر قوة والجدة هي الأكثر عرضة للنشر في المجلات المرموقة والحصول على استشهادات طويلة الأمد.

Prashant Garg, Thiemo Fetzer2026-02-25
💬 NLP

Bridging Gaps in Natural Language Processing for Yorùbá: A Systematic Review of a Decade of Progress and Prospects

تُحلل هذه المراجعة المنهجية للأدبيات عقدًا من الأبحاث (2014–2024) حول معالجة اللغات الطبيعية للغة اليوربا لتحديد التحديات الحرجة مثل ندرة البيانات والتعقيد النغمي، مع تسليط الضوء على الموارد والتقنيات الناشئة لتوجيه التطورات المستقبلية لهذه اللغة وغيرها من اللغات الأفريقية ذات الموارد المحدودة.

Toheeb Aduramomi Jimoh, Tabea De Wille, Nikola S. Nikolov2026-02-25
💬 NLP

ICE-ID: A Novel Historical Census Dataset for Longitudinal Identity Resolution

تقدم هذه الورقة ICE-ID، وهي مجموعة بيانات مرجعية مبتكرة تضم ما يقرب من مليون سجل من بيانات التعداد السكاني الأيسلندي الممتدة على مدار 220 عاماً، صُممت لمعالجة التحديات الفريدة في تحديد الهوية الطولي، مثل التسمية الأبوية والانزياح الزمني، مع توفير أدوات تحليلية شاملة وبروتوكول تقييم مطابق لواقع النشر.

Gonçalo Hora de Carvalho, Lazar S. Popov, Sander Kaatee, Mário S. Correia, Kristinn R. Thórisson, Tangrui Li, Pétur Húni (…)2026-02-25
💬 NLP

Programming by Backprop: An Instruction is Worth 100 Examples When Finetuning LLMs

تقدم هذه الورقة "البرمجة عبر الانتشار العكسي" (PBB)، وهو نظام تدريب يُمكّن النماذج اللغوية الكبيرة من اكتساب سلوكيات إجرائية قابلة لإعادة الاستخدام بكفاءة من التعليمات التصريحية، محققةً كفاءة في العينات تصل إلى 100 ضعف مقارنة بالتعلم من أمثلة التوضيح وحدها.

Jonathan Cook, Silvia Sapora, Arash Ahmadian, Akbir Khan, Tim Rocktaschel, Jakob Foerster, Laura Ruis2026-02-25
💬 NLP

RHYTHM: Reasoning with Hierarchical Temporal Tokenization for Human Mobility

إنَّ RHYTHM هو إطار عمل موحد يستفيد من نموذج لغوي كبير مجمد مع ترميز زمني هرمي للتنبؤ بكفاءة بالحركة البشرية عبر التقاط التبعيات الدورية متعددة المقاييس، محققاً تحسينات كبيرة في الدقة وسرعة التدريب مقارنة بالأساليب المتطورة.

Haoyu He, Haozheng Luo, Yan Chen, Qi R. Wang2026-02-25
💬 NLP

LD-MoLE: Learnable Dynamic Routing for Mixture of LoRA Experts

يقدم LD-MoLE آلية توجيه ديناميكية قابلة للتعلم والاشتقاق لمزيج من خبراء LoRA، والتي تحدد بشكل تكيفي عدد الخبراء النشطين لكل رمز وطبقة دون ضبط المعلمات الفائقة، محققاً أداءً هو الأفضل في فئته على معايير قياس النماذج اللغوية الكبيرة.

Yuan Zhuang, Yi Shen, Yuexin Bian, Qing Su, Shihao Ji, Yuanyuan Shi, Fei Miao2026-02-25
💬 NLP

Hearing the Order: Investigating Position Bias in Large Audio-Language Models

تقدم هذه الورقة أول استقصاء منهجي في انحياز الموضع في نماذج اللغة الصوتية الكبيرة، حيث تثبت من خلال تجارب مكثفة أن ترتيب خيارات الإجابة يؤثر بشكل كبير على الأداء والموثوقية، مع بيان أن استراتيجيات التبديل القائمة على الترتيب يمكن أن تخفف من هذه المشكلة بفعالية.

Yu-Xiang Lin, Chen-An Li, Sheng-Lun Wei, Po-Chun Chen, Hsin-Hsi Chen, Hung-yi Lee2026-02-25
💬 NLP

Towards Scalable Oversight via Partitioned Human Supervision

تقترح هذه الورقة إطار عمل للإشراف القابل للتوسع يستفيد من الإشراف البشري المجزأ، حيث يقدم الخبراء المتخصصون "تسميات تكميلية" تشير إلى الخيارات غير الصحيحة بدلاً من الإجابات الصحيحة، لتمكين تقييم وتحسين أنظمة الذكاء الاصطناعي الرائدة ذاتياً دون الحاجة إلى بيانات الحقيقة المطلقة.

Ren Yin, Takashi Ishida, Masashi Sugiyama2026-02-25
💬 NLP

A Parallel Cross-Lingual Benchmark for Multimodal Idiomaticity Understanding

تقدم هذه الورقة البحثية XMPIE، وهو معيار مرجعي متوازٍ عالي الجودة متعدد اللغات والوسائط يضم أكثر من 10,000 تعبير قد يكون اصطلاحيًا عبر 34 لغة، مصمم لتقييم ومقارنة قدرات أنظمة معالجة اللغات الطبيعية في فهم الاصطلاحية عبر مختلف اللغات والوسائط النصية-الصورية.

Dilara Torunoğlu-Selamet, Dogukan Arslan, Rodrigo Wilkens, Wei He, Doruk Eryiğit, Thomas Pickard, Adriana S. Pagano, Ali (…)2026-02-25