💬 NLP

Building a Custom Taxonomy of AI Skills and Tasks from the Ground Up with Job Postings

تقدم هذه الورقة TaxonomyBuilder، وهو إطار عمل يثبت أن تصفية بيانات منشورات الوظائف قبل معالجتها تؤدي إلى تصنيفات مهارات ذكاء اصطناعي أكثر وضوحاً وتخصصاً في المجال مقارنة باستخدام مجموعات نصوص غير مصفاة مع أدوات تجميع معززة بالنماذج اللغوية الكبيرة.

Stephen Meisenbacher, Peter Norlander2026-05-21
💬 NLP

Cross-lingual robustness of LLM-brain alignment and its computational roots

تُظهر هذه الدراسة أن النماذج اللغوية الكبيرة القائمة على تقنية "المحول" (transformer) تُبدي توافقاً قوياً ومستقراً عبر اللغات مع كل من نشاط القشرة الدماغية وما تحت القشرة أثناء الفهم اللغوي الطبيعي، وهو توافق مدفوع أساساً بتوافقات دلالية-معجمية موزعة بدلاً من المعالجة التنبؤية الهرمية أو الهندسة التمثيلية.

Ni Yang, Rui He, Philipp Homan, Iris Sommer, Davide Staub, Wolfram Hinzen2026-05-21
💬 NLP

GradeLegal: Automated Grading for German Legal Cases

تتناول هذه الورقة البحثية مشكلة الاختناق في تصحيح الامتحانات القانونية الألمانية من خلال التقييم المنهجي لـ 27 نموذجاً من نماذج اللغات الكبيرة، حيث وجدت أن النماذج الموجهة نحو الاستنتاج، عند دمجها مع حلول نموذجية ومعايير تصحيح، يمكنها محاكاة التصحيح الخبير في القانون العام بفعالية (وإن كان ذلك بدرجة أقل في القانون الجنائي)، وأن استراتيجيات التجميع يمكن أن تعزز الموثوقية بشكل أكبر.

Abdullah Al Zubaer, Lorenz Wendlinger, Simon Alexander Nonn, Michael Granitzer, Jelena Mitrovic2026-05-21
💬 NLP

LoCar: Localization-Aware Evaluation of In-Vehicle Assistants through Fine-Grained Sociolinguistic Control

تقدم هذه الورقة إطار تقييم مبتكر للمساعدين داخل المركبات يسلط الضوء على الفجوات الحرجة في النماذج اللغوية الكبيرة الحالية فيما يتعلق بالتحكم الدقيق في صيغ التبجيل الكورية والموثوقية الاستراتيجية للمحادثة، داعياً إلى التحول من الكفاءة العامة إلى التخصيص اللغوي الدقيق الموجه نحو السلامة.

Seogyeong Jeong, Kiwoong Park, Seyoung Song, Eunsu Kim, Ken E. Friedl, Jaeho Kim, Alice Oh2026-05-21
💬 NLP

WCXB: A Multi-Type Web Content Extraction Benchmark

تقدم هذه الورقة البحثية WCXB، وهو عبارة عن مجموعة بيانات مرجعية شاملة تضم 2,008 صفحة ويب عبر سبعة أنواع متميزة مع تعليقات توضيحية عالية الجودة، صُممت للتغلب على قيود المجموعات المرجعية الحالية التي تقتصر على المقالات فقط وكشف الفجوات الكبيرة في أداء أنظمة استخراج محتوى الويب الحالية.

Murrough Foley2026-05-21
💬 NLP

ACL-Verbatim: hallucination-free question answering for research

تقدم هذه الورقة ACL-Verbatim، وهو نظام للإجابة على الأسئلة خالٍ من الهلوسة مخصص للبحث، يستخدم طرقاً استخراجية لربط استعلامات المستخدم بنصوص حرفية في أرشيف ACL، مدعوماً بمجموعة بيانات حقائق جديدة يتفوق فيها نموذج ModernBERT بـ 150 مليون معلمة على أفضل مستخرجي النماذج اللغوية الكبيرة.

Gábor Recski, Szilveszter Tóth, Nadia Verdha, István Boros, Ádám Kovács2026-05-21
💬 NLP

Automated ICD Classification of Psychiatric Diagnoses: From Classical NLP to Large Language Models

تُظهر هذه الدراسة أن النماذج اللغوية الكبيرة المضبوطة بدقة، ولا سيما e5_large، تتفوق بشكل كبير على أساليب معالجة اللغات الطبيعية الكلاسيكية في أتمتة ربط الأوصاف النصية الحرة للطب النفسي باللغة الإسبانية بأكواد التصنيف الدولي للأمراض (ICD)، محققةً درجة F1 متوسطة دقيقة بلغت 0.866 على مجموعة بيانات تضم أكثر من 145,000 سجل.

Fernando Ortega, Raúl Lara-Cabrera, Jorge Dueñas-Lerín, Alejandro de la Torre-Luque, Mercé Salvador Robert, Enrique Baca (…)2026-05-21
💬 NLP

Do LLMs Know What Luxembourgish Borrows? Probing Lexical Neology in Low-Resource Multilingual Models

تقدم هذه الورقة LexNeo-Bench، وهو معيار لغوي للنيولوجيا (الاشتقاق اللفظي) في اللغة اللوكسمبورغية، لتوضيح أن حقن الرسوم البيانية للمعرفة اللغوية المهيكلة في المطالبات يحسن بشكل كبير قدرة النماذج اللغوية الكبيرة على تصنيف الاقتراضات اللفظية في لغات الاتصال ذات الموارد المنخفضة، رغم أن اكتشاف النيولوجيا لا يزال يشكل تحدياً.

Nina Hosseini-Kivanani2026-05-21
💬 NLP

LamPO: A Lambda Style Policy Optimization for Reasoning Language Models

تُعدُّ de l'ampO طريقةً مبتكرةً لتحسين السياسات لنماذج اللغة الاستدلالية، حيث تعزز التعلم المعزز بمكافآت قابلة للتحقق عبر استبدال ميزات المجموعات القياسية بميزة مفككة ثنائية لترسيخ المعلومات العلاقاتية دقيقة التفاصيل، مما يحقق تدريبًا أكثر استقرارًا وأداءً فائقًا في الاختبارات المعيارية الرياضية والعلمية مقارنةً بالأساليب الحالية مثل GRPO.

Zhe Yuan, Yipeng Zhou, Jinghan Li, Xinyuan Chen, Bowen Deng, Zhiqian Chen, Liang Zhao2026-05-21
💬 NLP

Tracing the ongoing emergence of human-like reasoning in Large Language Models

تكشف هذه الورقة أنه بينما تُظهر النماذج اللغوية الكبيرة دقة عالية في المنطق الدلالي، فإنها تفشل عموماً في محاكاة الاستدلال البراغماتي الذي يسمح للبشر بإثراء الجمل الشرطية بمعانٍ تعتمد على السياق، وهي قدرة تظل مهارة ناشئة بغض النظر عن بنية النموذج أو توجه التدريب.

Paolo Morosi, Nikoleta Pantelidou, Fritz Günther, Elena Pagliarini, Evelina Leivada2026-05-21