🤖 AI

Improving Lexical Difficulty Prediction with Context-Aligned Contrastive Learning and Ridge Ensembling

تقترح هذه الورقة "الارتباط التبايني المتوافق مع السياق" (Context-Aligned Contrastive Regression)، وهو إطار عمل مبتكر يجمع بين تجميع انحدار ريدج (Ridge regression ensembling) والتعلم التبايني عبر الرؤى والترتيبي لتعزيز التنبؤ بالصعوبة المعجمية من خلال تحسين المحاذاة عبر اللغات، واستيعاب الهياكل الترتيبية، والتخفيف من الانحيازات المنهجية للنماذج.

Wicaksono Leksono Muhamad, Joanito Agili Lopo, Tsamarah Rana Nugraha, Ahmad Cahyono Adi, Muhammad Oriza Nurfajri2026-05-12
🤖 machine learning

LLiMba: Sardinian on a Single GPU -- Adapting a 3B Language Model to a Vanishing Romance Language

تقدم الورقة البحثية نموذج LLiMba، وهو نموذج لغوي للغة السردينية بـ 3 مليارات معلمة تم تكييفه على وحدة معالجة رسومات استهلاكية واحدة عبر التدريب المسبق المستمر والضبط الدقيق، مما يثبت أن تكوين rsLoRA عالي الرتبة يتفوق على طرق التكيف الأخرى في جودة الترجمة مع تسليط الضوء على القيود الحرجة للمقاييس القياسية في رصد الإخفاقات النوعية مثل تسرب النصوص (script leakage) والهلوسة الواقعية.

Luca Ballore2026-05-12
🤖 machine learning

GAMBIT: A Three-Mode Benchmark for Adversarial Robustness in Multi-Agent LLM Collectives

تقدم هذه الورقة GAMBIT، وهو معيار ومجموعة بيانات مبتكرة تتميز بخصوم تكيفيين متطورين في مجموعات من النماذج اللغوية الكبيرة متعددة الوكلاء، لإثبات أن التقييم بنمط "الصفر محاولة" (zero-shot) مضلل تجاه التهديدات التكيفية، وأن إعادة المعايرة بنمط "القليل من الأمثلة" (few-shot) أمر بالغ الأهمية للكشف القوي عن المنتحلين.

Alexandre Le Mercier, Chris Develder, Thomas Demeester2026-05-12
💬 NLP

Evaluating Pragmatic Reasoning in Large Language Models: Evidence from Scalar Diversity

تُظهر هذه الدراسة أن الاستدلال البراغماتي (التداولي) في النماذج اللغوية الكبيرة، والذي تم تقييمه من خلال التنوع القياسي، ليس كفاءة مستقرة بل هو تفاعل متغير بين التمثيلات الاحتمالية الداخلية وسلوكيات التلقين المستحثة بالمهام، مما يسلط الضوء على التأثير الحاسم لتصميم التقييم على تفسير قدرات النموذج.

Ye-eun Cho2026-05-12
🤖 AI

Phase Transitions in Affective Meaning Divergence: The Hidden Drift Before the Break

تُصوّر هذه الورقة البحثية تباعد المعنى الوجداني (AMD) كمتنبئ حاسم لانهيار العلاقات، مُثبتةً من خلال النمذجة القائمة على نظرية الألعاب والتحليل التجريبي للبيانات الحوارية أن المحادثات تمر بانهيار مفاجئ وتراجعي في تنسيق الإصلاح عندما يتجاوز الحمل الناجم عن تباعد المعنى الوجداني عتبة محددة، وهي ظاهرة تتميز بخصائص "التباطؤ الحرج" التي تتفوق على مقاييس السُميّة والمشاعر التقليدية.

Napassorn Litchiowong2026-05-12
💬 NLP

Language-Conditioned Visual Grounding with CLIP Multilingual

تعزل هذه الورقة المشفر البصري كعامل ثابت عبر ثلاث عشرة لغة لتثبت أن التفاوتات في التأسيس الأرضي البصري متعدد اللغات تنبع أساساً من قيود فرع النص وعدم المحاذاة المكانية بدلاً من انهيار الإشارة، مما يكشف أن توسيع النموذج البصري يحسن بعض اللغات ذات الموارد المنخفضة بينما يؤدي إلى تفاقم الوضع في لغات أخرى ويؤكد الجدوى الفعالة من حيث استهلاك الطاقة للمنهجية.

J. de Curtò, Mauro Liz, I. de ZarzÃ2026-05-12
💬 NLP

Fin-Bias: Comprehensive Evaluation for LLM Decision-Making under human bias in Finance Domain

تقدم هذه الورقة Fin-Bias، وهو معيار شامل يستخدم الآلاف من تقارير المحللين طويلة الصيغة لتقييم كيفية إظهار النماذج اللغوية الكبيرة لسلوك القطيع تحت تأثير التحيز البشري في اتخاذ القرارات المالية، مع اقتراح طريقة أيضاً للتخفيف من حدة هذا التحيز وتعزيز دقة التنبؤ المستقل.

Xiaoyu Hu, Jinman Zhao2026-05-12
📊 statistics

From Traditional Taggers to LLMs: A Comparative Study of POS Tagging for Medieval Romance Languages

تقدم هذه الورقة دراسة تجريبية منهجية تثبت أن النماذج اللغوية الكبيرة، لا سيما عند ضبطها بدقة أو الاستفادة منها عبر التعلم بنقل المعرفة عبر اللغات، تتفوق بشكل كبير على الطرق التقليدية في وسم أجزاء الكلام للغات الرومانسية من العصور الوسطى ذات الموارد المحدودة مثل الأوكسيتانية والكتالونية والفرنسية.

Matthias Schöffel, Esteban Garces Arias2026-05-12
🧬 biology

Meow-Omni 1: A Multimodal Large Language Model for Feline Ethology

تقدم الورقة البحثية Meow-Omni 1، وهو نموذج لغوي كبير جديد مفتوح المصدر رباعي الأنماط يدمج الفيديو، والصوت، والسلاسل الزمنية الفسيولوجية، والنصوص لتحقيق حالة متطورة في التعرف على نوايا القطط من خلال معالجة تحدي التباس المعنى في تحليل سلوك الحيوان.

Jucheng Hu, Zhangquan Chen, Yulin Chen, Chengjie Hong, Liang Zhou, Tairan Wang, Sifei Li, Giulio Zhu, Feng Zhou, Yiheng (…)2026-05-12
🤖 AI

Lost in Translation? Exploring the Shift in Grammatical Gender from Latin to Occitan

تقدم هذه الورقة إطار عمل للتعلم العميق القابل للتفسير مع مُجزئ نصوص (tokenizer) مُحسَّن لتحليل التحول التاريخي من نظام النوع النحوي الثلاثي في اللاتينية إلى النظام الثنائي في الأوكسيتانية، مع قياس المساهمات النسبية للميزات الصرفية والسياق الجملي في التنبؤ بالنوع.

Ahan Chatterjee, Matthias Schöffel, Matthias Aßenmacher, Esteban Garces Arias2026-05-12