💬 NLP

Beyond Unimodal Shortcuts: MLLMs as Cross-Modal Reasoners for Grounded Named Entity Recognition

تتناول هذه الورقة البحثية انحياز النمط (modality bias) في النماذج اللغوية الكبيرة متعددة الوسائط (MLLMs) الذي يعيق عملية التعرف على الكيانات المسماة المرتكزة (Grounded Named Entity Recognition) من طرف إلى طرف، وذلك عبر اقتراح "الاستدلال المتسق المدرك للنمط" (Modality-aware Consistency Reasoning - MCR)، وهو إطار عمل يستخدم "حقن مخطط الاستدلال متعدد الأنماط" (Multi-style Reasoning Schema Injection) و"التحسين القابل للتحقق الموجه بالقيود" (Constraint-guided Verifiable Optimization) لفرض تحقق صارم عبر الوسائط وتحقيق أداء فائق.

Jinlong Ma, Yu Zhang, Xuefeng Bai, Kehai Chen, Yuwei Wang, Zeming Liu, Jun Yu, Min Zhang2026-02-05
💬 NLP

AIANO: Enhancing Information Retrieval with AI-Augmented Annotation

تقدم الورقة البحثية AIANO، وهي أداة وسم معززة بالذكاء الاصطناعي تدمج المساعدة من النماذج اللغوية الكبيرة مع الخبرة البشرية لتسريع إنشاء مجموعات البيانات بشكل كبير، وتحسين سهولة الاستخدام، وتعزيز دقة الاسترجاع لمهام استرجاع المعلومات.

Sameh Khattab, Marie Bauer, Lukas Heine, Till Rostalski, Jens Kleesiek, Julian Friedrich2026-02-05
💬 NLP

Trust The Typical

تقدم الورقة البحثية إطار عمل "Trust The Typical" (T3)، وهو إطار عمل جديد لسلامة النماذج اللغوية الكبيرة يعامل الحماية كمسألة اكتشاف للبيانات خارج التوزيع من خلال تعلم توزيع المطالبات الآمنة دون الحاجة إلى بيانات تدريب ضارة، مما يحقق أداءً رائدًا عبر مختلف التهديدات واللغات مع الحفاظ على انخفاض تكلفة الاستدلال.

Debargha Ganguly, Sreehari Sankar, Biyao Zhang, Vikash Singh, Kanan Gupta, Harshini Kavuru, Alan Luo, Weicong Chen, Warr (…)2026-02-05
💬 NLP

Beyond Holistic Scores: Automatic Trait-Based Quality Scoring of Argumentative Essays

تقترح هذه الورقة البحثية وتقيم نهجين متكاملين للتصحيح التلقائي للمقالات الجدلية بناءً على السمات، حيث تُظهر أن نموذج BigBird الخاضع للإشراف مع الانحدار الرتبي يتفوق بشكل كبير على النماذج المرجعية في التوافق مع المقيمين البشريين، بينما توفر النماذج اللغوية الكبيرة الصغيرة مفتوحة المصدر بديلاً تنافسياً يحافظ على الخصوصية لتوليد تعليقات تفسيرية متوافقة مع معايير التقييم دون الحاجة إلى ضبط دقيق خاص بالمهمة.

Lucile Favero, Juan Antonio Pérez-Ortiz, Tanja Käser, Nuria Oliver2026-02-05
💬 NLP

RexBERT: Context Specialized Bidirectional Encoders for E-commerce

تقدم الورقة البحثية RexBERT، وهي عائلة من مشفرات نمط BERT المتخصصة التي تم تدريبها على مجموعة بيانات ضخمة للتجارة الإلكترونية مكونة من 350 مليار رمز باستخدام وصفة تدريب مسبق ثلاثية المراحل، والتي تتفوق على النماذج العامة الأكبر حجمًا في المهام الخاصة بالمجال رغم امتلاكها عددًا أقل بكثير من المعلمات.

Rahul Bajaj, Anuj Garg2026-02-05
💬 NLP

Mapping the Web of Science, a large-scale graph and text-based dataset with LLM embeddings

تُثبت هذه الورقة العملية المتمثلة في الجمع بين نماذج تضمين النماذج اللغوية الكبيرة والتحليل القائم على الرسوم البيانية لرسم المشهد الدلالي لمجموعة بيانات "Web of Science"، والتي تحتوي على ما يقرب من 56 مليون منشور علمي.

Tim Kunt, Annika Buchholz, Imene Khebouri, Thorsten Koch, Ida Litzel, Thi Huong Vu2026-02-05
💬 NLP

Outcome Accuracy is Not Enough: Aligning the Reasoning Process of Reward Models

تقدم هذه الورقة البحثية "اتساق التعليل" (Rationale Consistency) كمعيار حاسم لمعالجة المحاذاة الخادعة لنماذج المكافأة التوليدية، مقترحةً إشارة تدريب هجينة تجمع بين محاذاة الاستنتاج ودقة النتيجة لتحقيق أداء يمثل حالة متطورة في هذا المجال ومنع انخفاض جودة الاستنتاج الملحوظ في التدريب التقليدي القائم على النتيجة فقط.

Binghai Wang, Yantao Liu, Yuxuan Liu, Tianyi Tang, Shenzhi Wang, Chang Gao, Chujie Zheng, Yichang Zhang, Le Yu, Shixuan (…)2026-02-05
💬 NLP

Delving into Muon and Beyond: Deep Analysis and Extensions

تحلل هذه الورقة مُحسِّن "Muon" من خلال منظور طيفي موحد، حيث تقدم عائلة من التحويلات الطيفية وتكرار "نيوتن" المقترن الفعال لتوضيح أنه بينما يعمل "Muon" كطريقة فعالة للتطبيع الطيفي، فإنه لا يتفوق باستمرار على "Adam" ويكون أكثر استقرارًا عند تطبيقه على تحديثات "RMS-normalized" بدلاً من تحديثات العزم الأول.

Xianbiao Qi, Marco Chen, Jiaquan Ye, Yelin He, Rong Xiao2026-02-05
💬 NLP

ERNIE 5.0 Technical Report

تقدم هذه الورقة نموذج ERNIE 5.0، وهو أول نموذج تأسيسي موحد ذاتي الانحدار بمقياس إنتاجي وتريليونات المعلمات تم الكشف عنه علنًا، والذي يدعم أصليًا الفهم والتوليد متعدد الوسائط عبر النصوص والصور والفيديو والصوت من خلال بنية خليط خبراء فائقة الندرة ونموذج تدريب مرن ومبتكر.

Haifeng Wang, Hua Wu, Tian Wu, Yu Sun, Jing Liu, Dianhai Yu, Yanjun Ma, Jingzhou He, Zhongjun He, Dou Hong, Qiwen Liu, S (…)2026-02-05
💬 NLP

LiteToken: Removing Intermediate Merge Residues From BPE Tokenizers

تقدم هذه الورقة LiteToken، وهي طريقة تحدد وتزيل الرموز "المتبقية" غير المتكررة من مفردات BPE لتقليل معلمات النموذج وتحسين المتانة ضد المدخلات الضوضائية، وغالبًا دون الحاجة إلى ضبط إضافي للنماذج سابقة التدريب.

Yike Sun, Haotong Yang, Zhouchen Lin, Muhan Zhang2026-02-05