💬 NLP

Language-Conditioned Visual Grounding with CLIP Multilingual

تعزل هذه الورقة المشفر البصري كعامل ثابت عبر ثلاث عشرة لغة لتثبت أن التفاوتات في التأسيس الأرضي البصري متعدد اللغات تنبع أساساً من قيود فرع النص وعدم المحاذاة المكانية بدلاً من انهيار الإشارة، مما يكشف أن توسيع النموذج البصري يحسن بعض اللغات ذات الموارد المنخفضة بينما يؤدي إلى تفاقم الوضع في لغات أخرى ويؤكد الجدوى الفعالة من حيث استهلاك الطاقة للمنهجية.

J. de Curtò, Mauro Liz, I. de ZarzÃ2026-05-12
💬 NLP

Fin-Bias: Comprehensive Evaluation for LLM Decision-Making under human bias in Finance Domain

تقدم هذه الورقة Fin-Bias، وهو معيار شامل يستخدم الآلاف من تقارير المحللين طويلة الصيغة لتقييم كيفية إظهار النماذج اللغوية الكبيرة لسلوك القطيع تحت تأثير التحيز البشري في اتخاذ القرارات المالية، مع اقتراح طريقة أيضاً للتخفيف من حدة هذا التحيز وتعزيز دقة التنبؤ المستقل.

Xiaoyu Hu, Jinman Zhao2026-05-12
📊 statistics

From Traditional Taggers to LLMs: A Comparative Study of POS Tagging for Medieval Romance Languages

تقدم هذه الورقة دراسة تجريبية منهجية تثبت أن النماذج اللغوية الكبيرة، لا سيما عند ضبطها بدقة أو الاستفادة منها عبر التعلم بنقل المعرفة عبر اللغات، تتفوق بشكل كبير على الطرق التقليدية في وسم أجزاء الكلام للغات الرومانسية من العصور الوسطى ذات الموارد المحدودة مثل الأوكسيتانية والكتالونية والفرنسية.

Matthias Schöffel, Esteban Garces Arias2026-05-12
🧬 biology

Meow-Omni 1: A Multimodal Large Language Model for Feline Ethology

تقدم الورقة البحثية Meow-Omni 1، وهو نموذج لغوي كبير جديد مفتوح المصدر رباعي الأنماط يدمج الفيديو، والصوت، والسلاسل الزمنية الفسيولوجية، والنصوص لتحقيق حالة متطورة في التعرف على نوايا القطط من خلال معالجة تحدي التباس المعنى في تحليل سلوك الحيوان.

Jucheng Hu, Zhangquan Chen, Yulin Chen, Chengjie Hong, Liang Zhou, Tairan Wang, Sifei Li, Giulio Zhu, Feng Zhou, Yiheng (…)2026-05-12
🤖 AI

Lost in Translation? Exploring the Shift in Grammatical Gender from Latin to Occitan

تقدم هذه الورقة إطار عمل للتعلم العميق القابل للتفسير مع مُجزئ نصوص (tokenizer) مُحسَّن لتحليل التحول التاريخي من نظام النوع النحوي الثلاثي في اللاتينية إلى النظام الثنائي في الأوكسيتانية، مع قياس المساهمات النسبية للميزات الصرفية والسياق الجملي في التنبؤ بالنوع.

Ahan Chatterjee, Matthias Schöffel, Matthias Aßenmacher, Esteban Garces Arias2026-05-12
🤖 machine learning

Sparse Layers are Critical to Scaling Looped Language Models

تُظهر الورقة البحثية أن الجمع بين بنيات "خليط الخبراء" (MoE) وآليات تكرار الطبقات والخروج المبكر يُمكّن النماذج اللغوية من التفوق على نماذج "ترانسفورمر" القياسية في كفاءة التوسع مع تقليل تكاليف الذاكرة والاستدلال بشكل كبير.

Ryan Lee, Jacob Biloki, Edward J. Hu, Jonathan May2026-05-12
🤖 AI

WorldSpeech: A Multilingual Speech Corpus from Around the World

تقدم الورقة البحثية WorldSpeech، وهو متن لغوي ضخم متعدد اللغات يحتوي على 65,000 ساعة من البيانات الصوتية والنصية المتوافقة عبر 76 لغة، مما يحسن بشكل كبير أداء التعرف التلقائي على الكلام للغات ذات الموارد المنخفضة من خلال تقليل معدلات خطأ الكلمات بمتوسط قدره 63.5%.

Antonis Asonitis, Luca A. Lanzendörfer, Frédéric Berdoz, Roger Wattenhofer2026-05-12
🤖 AI

Open Ontologies: Tool-Augmented Ontology Engineering with Stable Matching Alignment

تقدم هذه الورقة "Open Ontologies"، وهو نظام مفتوح المصدر قائم على لغة Rust، يوضح أن المطابقة المستقرة بنسبة 1 إلى 1 هي العامل الحاسم للمحاذاة عالية الجودة للأنطولوجيا، وأن الوصول المنظم إلى أدوات بروتوكول سياق النموذج (MCP) يتفوق بشكل كبير على كل من قراءة الملفات الخام والأساسات التي لا تعتمد على الملفات في التفاعل مع الأنطولوجيا المدفوع بالنماذج اللغوية الكبيرة.

Fabio Rovai2026-05-12
🤖 AI

Agentic MIP Research: Accelerated Constraint Handler Generation

تقدم هذه الورقة إطار عمل وكيلِيّاً يستفيد من النماذج اللغوية الكبيرة لتوليد والتحقق من وتقييم معالجات قيود SCIP لبرمجة الأعداد الصحيحة المختلطة بشكل مستقل، مما نجح في استعادة هياكل القيود العالمية واكتشاف استراتيجيات انتشار مبتكرة تُحسن أداء الحلّال على النماذج المرجعية.

Liding Xu, Yugeng Zhou, Sebastian Pokutta2026-05-12
🤖 AI

Emergent Semantic Role Understanding in Language Models

تُثبت هذه الورقة أن فهم الأدوار الدلالية يظهر جزئياً في نماذج المحولات المكونة من فك تشفير فقط (decoder-only transformers) والمجمدة أثناء مرحلة ما قبل التدريب، كما يتضح من خلال المسابير الخطية، رغم أن الأداء الكامل يتطلب الضبط الدقيق، كما يصبح التمثيل الداخلي لهذه الأدوار موزّعاً بشكل متزايد مع زيادة حجم النموذج.

Carla Griffiths, Mirco Musolesi2026-05-12