💬 NLP

Quantifying and extending the coverage of spatial categorization data sets

تُظهر هذه الورقة أن النماذج اللغوية الكبيرة يمكنها التوافق بفعالية مع تسميات التصنيف المكاني البشرية لتوجيه التوسع الاستراتيجي لسلسلة صور العلاقات الطوبولوجية (TRPS)، مما أسفر عن مجموعة بيانات جديدة تضم 42 مشهداً توفر تغطية متفوقة للعلاقات المكانية مقارنة بالتوسعات السابقة.

Wanchun Li, Alexandra Carstensen, Yang Xu, Terry Regier, Charles Kemp2026-03-11
🤖 AI

Investigating Gender Stereotypes in Large Language Models via Social Determinants of Health

تتقصى هذه الدراسة التحيز الجنساني في نماذج اللغات الكبيرة ضمن سياقات الرعاية الصحية الفرنسية، مظهرةً أن هذه النماذج تعتمد على صور نمطية متأصلة عند معالجة التفاعلات بين النوع الاجتماعي والمحددات الاجتماعية الأخرى للصحة، مما يسلط الضوء على الحاجة إلى تقييمات خاصة بالسياق تتجاوز تقييم العوامل الفردية بشكل منعزل.

Trung Hieu Ngo, Adrien Bazoge, Solen Quiniou, Pierre-Antoine Gourraud, Emmanuel Morin2026-03-11
💬 NLP

CyberThreat-Eval: Can Large Language Models Automate Real-World Threat Research?

تقدم هذه الورقة CyberThreat-Eval، وهو معيار مرجعي مُصنف من قبل خبراء ومستمد من سير عمل استخبارات التهديدات السيبرانية في العالم الحقيقي، والذي يعالج أوجه القصور في التقييمات الحالية من خلال تقييم النماذج اللغوية الكبيرة عبر مسار العمل الكامل من الفرز إلى إعداد التقارير باستخدام مقاييس تركز على المحلل، مما يكشف عن فجوات كبيرة في قدرة النماذج الحالية على التعامل مع الرؤى الأمنية الدقيقة والقابلة للتنفيذ.

Xiangsen Chen, Xuan Feng, Shuo Chen, Matthieu Maitre, Sudipto Rakshit, Diana Duvieilh, Ashley Picone, Nan Tang2026-03-11
💬 NLP

Modelling the Diachronic Emergence of Phoneme Frequency Distributions

تُثبت هذه الورقة أن الانتظامات الإحصائية الرئيسية في توزيعات تكرار الفونيمات، مثل الأنماط ذات الذيول الأسية والعلاقة العكسية بين حجم المخزون والاعتلاج النسبي، يمكن أن تنبثق طبيعياً من نموذج عشوائي للتغير الصوتي عبر التاريخ يتضمن الحمل الوظيفي وتفضيلاً استقرارياً لحجم المخزون، بدلاً من اشتراط آليات تحسين صريحة.

Fermín Moscoso del Prado Martín, Suchir Salhan2026-03-11
🤖 machine learning

You Didn't Have to Say It like That: Subliminal Learning from Faithful Paraphrases

تُظهر هذه الورقة أن النماذج اللغوية يمكنها اكتساب سمات سلوكية من نموذج معلم بشكل خفي عبر "التعلم اللاشعوري" من خلال إعادة الصياغة الأمينة، حيث يتبنى النموذج الطالب تفضيلات النموذج المعلم حتى عندما تكون المحتويات المعاد صياغتها غير مرتبطة دلالياً أو تتعارض صراحة مع تلك التفضيلات، مما يجعل الفحص القائم على المحتوى غير فعال.

Isaia Gisler (ETH Zürich), Zhonghao He (University of Cambridge), Tianyi Qiu (Peking University)2026-03-11
💬 NLP

Build, Borrow, or Just Fine-Tune? A Political Scientist's Guide to Choosing NLP Models

يرشد هذا البحث علماء السياسة في اختيار استراتيجيات معالجة اللغات الطبيعية من خلال إثبات أن الضبط الدقيق للنماذج العامة مثل ModernBERT غالبًا ما يكون كافيًا للمهام عالية التكرار، مع حصر الحاجة إلى نماذج متخصصة ومحددة بالمجال لفئات الأحداث النادرة حيث تكون فجوات الأداء أكثر وضوحًا.

Shreyas Meher2026-03-11
💬 NLP

Surgical Repair of Collapsed Attention Heads in ALiBi Transformers

تحدد هذه الورقة البحثية اعتلالاً في انهيار الانتباه المنهجي في نماذج BLOOM ناتجاً عن ترميز ALiBi الموضعي، وتستعرض تقنية إعادة تهيئة جراحية نجحت في استعادة كافة رؤوس الانتباه الوظيفية تقريباً، مما يثبت أن تكوينات الانتباه المدربة مسبقاً هي نقاط صغرى محلية غير مثالية.

Palmer Schallon2026-03-11
💬 NLP

Understanding the Interplay between LLMs' Utilisation of Parametric and Contextual Knowledge: A keynote at ECIR 2025

تستكشف هذه الكلمة الرئيسية في مؤتمر ECIR 2025 التفاعل الحرج بين المعرفة البارامترية الداخلية للنموذج اللغوي والمعلومات السياقية الخارجية، مع التركيز على طرق التشخيص لتحديد تعارضات المعرفة واستراتيجيات تحسين قدرة النموذج على استخدام السياق المسترجع بفعالية.

Isabelle Augenstein2026-03-11
🤖 AI

Automatic Cardiac Risk Management Classification using large-context Electronic Patients Health Records

تُظهر هذه الدراسة أن بنية "ترانسفورمر" (Transformer) مخصصة تتفوق على كل من نماذج التعلم الآلي التقليدية ونماذج اللغات الكبيرة التوليدية ذات القدرة على التعلم الصفري في التصنيف التلقائي لمخاطر أمراض القلب من السجلات الصحية الإلكترونية الهولندية غير المهيكلة ذات السياق الطويل، مما يوفر بديلاً قوياً للترميز الإداري اليدوي لإدارة مخاطر القلب والأوعية الدموية لدى كبار السن.

Jacopo Vitale, David Della Morte, Luca Bacco, Mario Merone, Mark de Groot, Saskia Haitjema, Leandro Pecchia, Bram van Es2026-03-11
💬 NLP

Fusing Semantic, Lexical, and Domain Perspectives for Recipe Similarity Estimation

تقترح هذه الورقة إطار عمل متعدد المنظور لتقدير تشابه الوصفات من خلال دمج البيانات الدلالية واللفظية والبيانات الغذائية الخاصة بالمجال، والتي تم التحقق من صحتها بواسطة خبراء المجال لتحديد العوامل الأكثر تأثيراً في اتخاذ القرار البشري للتطبيقات في مجال التغذية الشخصية وتوليد الوصفات آلياً.

Denica Kjorvezir, Danilo Najkov, Eva Valencič, Erika Jesenko, Barbara Koroišić Seljak, Tome Eftimov, Riste Stojanov2026-03-11