💬 NLP

Empowering Healthcare Practitioners with Language Models: Structuring Speech Transcripts in Two Real-World Clinical Applications

تتناول هذه الورقة التحديات غير المستكشفة المتمثلة في التقارير الجدولية المهيكلة من إملاءات الممرضين واستخراج الأوامر الطبية من الاستشارات، وذلك من خلال تقييم نماذج لغوية كبيرة متنوعة، واقتراح مسار وكيل (agentic pipeline) لتوليد بيانات اصطناعية، وإصدار أول مجموعات بيانات مفتوحة المصدر (SYNUR وSIMORD) لدعم مهام التوثيق السريري الحرجة هذه.

Jean-Philippe Corbeil, Asma Ben Abacha, George Michalopoulos, Phillip Swazinna, Miguel Del-Agua, Jerome Tremblay, Akila (…)2026-02-13
💬 NLP

Do language models accommodate their users? A study of linguistic convergence

تُظهر هذه الدراسة أن النماذج اللغوية الكبيرة تُبدي تقارباً لغوياً قوياً مع أساليب المستخدمين، وغالباً ما تفرط في التكيف مقارنة بالبشر، حيث تُظهر النماذج المضبوطة بالتعليمات والأكبر حجماً تقارباً أقل من نظيراتها المسبقة التدريب والأصغر حجماً.

Terra Blevins, Susanne Schmalwieser, Benjamin Roth2026-02-13
💬 NLP

TABLET: A Large-Scale Dataset for Robust Visual Table Understanding

تقدم هذه الورقة البحثية TABLET، وهو مجموعة بيانات واسعة النطاق تضم 4 ملايين مثال مستندة إلى مليوني جدول فريد من العالم الحقيقي مع الحفاظ على التصورات المرئية، مما يعزز بشكل كبير من قوة وأداء نماذج الرؤية واللغة في مهام فهم الجداول المرئية.

Iñigo Alonso, Imanol Miranda, Eneko Agirre, Mirella Lapata2026-02-13
💬 NLP

Learning to Route: A Rule-Driven Agent Framework for Hybrid-Source Retrieval-Augmented Generation

تقترح هذه الورقة إطار عمل لوكيل قائم على القواعد لعملية التوليد المعزز بالاسترجاع هجين المصدر، يقوم بتوجيه الاستعلامات ديناميكيًا بين قواعد البيانات العلاقاتية والمستندات غير المهيكلة باستخدام قواعد تكيفية وتخزين مؤقت ميتا لتحقيق دقة وكفاءة أعلى من النماذج المرجعية الثابتة أو المتعلمة الحالية.

Haoyue Bai, Haoyu Wang, Shengyu Chen, Zhengzhang Chen, Lu-An Tang, Wei Cheng, Haifeng Chen, Yanjie Fu2026-02-13
💬 NLP

GOLD PANNING: Strategic Context Shuffling for Needle-in-Haystack Reasoning

تقدم الورقة البحثية GOLD PANNING، وهو إطار عمل بايزي (Bayesian) بنظام الصندوق الأسود يخفف من انحياز الموضع لدى النماذج اللغوية الكبيرة في الاستدلال طويل السياق، وذلك عبر إعادة ترتيب المستندات بشكل تكراري لترسيخ المعلومات ذات الاعتقاد العالي في المواضع التشخيصية، مما يحقق تحديداً فعالاً للهدف بعدد استعلامات أقل بكثير من الطرق الحالية.

Adam Byerly, Daniel Khashabi2026-02-13
💬 NLP

A Cocktail-Party Benchmark: Multi-Modal dataset and Comparative Evaluation Results

تقدم هذه الورقة مهمة التعرف متعدد الوسائط المعتمد على السياق (MCoRec) لتحدي CHiME التاسع، حيث تقدم مجموعة بيانات جديدة وأنظمة أساسية تُظهر كيف يؤدي دمج الإشارات المرئية إلى تحسين القدرة على حل تداخل الكلام في المحادثات الجماعية الطبيعية وغير المكتوبة بشكل كبير مقارنة بالنهج المعتمد على الصوت فقط.

Thai-Binh Nguyen, Katerina Zmolikova, Pingchuan Ma, Ngoc Quan Pham, Christian Fuegen, Alexander Waibel2026-02-13
💬 NLP

Evaluating Modern Large Language Models on Low-Resource and Morphologically Rich Languages:A Cross-Lingual Benchmark Across Cantonese, Japanese, and Turkish

تقدم هذه الورقة معياراً شاملاً متعدد اللغات لتقييم سبعة من النماذج اللغوية الكبيرة المتطورة في اللغات الكانتونية واليابانية والتركية عبر أربع مهام متنوعة، مما يكشف أنه بينما تتصدر النماذج المملوكة الرائدة في الأداء، لا تزال هناك تحديات كبيرة في التعامل مع التعقيد الصرفي والفروق الثقافية الدقيقة، لا سيما بالنسبة للنماذج مفتوحة المصدر الأصغر حجماً.

Chengxuan Xia, Qianye Wu, Hongbin Guan, Sixuan Tian, Yilun Hao, Xiaoyu Wu2026-02-13
💬 NLP

Eroding the Truth-Default: A Causal Analysis of Human Susceptibility to Foundation Model Hallucinations and Disinformation in the Wild

تقدم هذه الورقة إطار عمل ثنائي المحاور (JudgeGPT وRogueGPT) وتوظف النماذج السببية الهيكلية لتوضيح أن قابلية البشر للتأثر بهلوسة النماذج التأسيسية مدفوعة بالألفة مع الأخبار المزيفة و"فخ الطلاقة" للنصوص الاصطناعية عالية الجودة أكثر من توجهها السياسي، مما يشير إلى أن التدخلات الفعالة يجب أن تستهدف مراقبة المصدر المعرفي بدلاً من التقسيم الديموغرافي.

Alexander Loth, Martin Kappes, Marc-Oliver Pahl2026-02-13
💬 NLP

Evaluating Metalinguistic Knowledge in Large Language Models across the World's Languages

تقدم هذه الورقة معياراً متعدد اللغات يعتمد على أطلس العالم لبنى اللغات لتقييم المعرفة الميتالينغويستية (الميتا-لغوية) لدى النماذج اللغوية الكبيرة، كاشفةً أن أداءها متوسط، ومجزأ، ويعتمد بشكل كبير على توافر الموارد الرقمية بدلاً من الكفاءة النحوية القابلة للتعميم.

Tjaša Arčon, Matej Klemen, Marko Robnik-Šikonja, Kaja Dobrovoljc2026-02-13