💬 NLP

GPT-NL Public Corpus: A Permissively Licensed, Dutch-First Dataset for LLM Pre-training

تقدم الورقة البحثية مجموعة بيانات GPT-NL العامة، وهي مجموعة بيانات ذات ترخيص ميسر تضم 36 مليار رمز فريد للغة الهولندية إلى جانب بيانات منسقة باللغات الإنجليزية والبرمجية والألمانية/الدنماركية، صُممت لتسهيل تطوير نماذج لغوية تجارية قانونية ومفيدة.

Jesse van Oort, Frank Brinkkemper, Erik de Graaf, Bram Vanroy, Saskia Lensink2026-04-03
💬 NLP

Uncertainty-Aware Variational Reward Factorization via Probabilistic Preference Bases for LLM Personalization

تقدم هذه الورقة البحثية "تجزئة عامل المكافأة التبايني" (VRF)، وهو إطار عمل مدرك لعدم اليقين يعمل على تخصيص النماذج اللغوية الكبيرة من خلال تمثيل تفضيلات المستخدم كتوزيعات تباينية في مساحة مشتركة، مما يؤدي إلى تحسين دقة وموثوقية الاستدلال مقارنة بالطرق الحتمية الحالية عبر مختلف المعايير والسيناريوهات.

Gyuseok Lee, Wonbin Kweon, Zhenrui Yue, SeongKu Kang, Jiawei Han, Dong Wang2026-04-03
💬 NLP

CARE: Privacy-Compliant Agentic Reasoning with Evidence Discordance

يقدم هذا البحث CARE، وهو إطار عمل استدلالي وكيلِيّ ممتثل للخصوصية يجمع بين نموذج لغوي كبير بعيد لتوليد توجيه مهيكل ونموذج لغوي كبير محلي لاتخاذ القرارات القائمة على الأدلة لحل تضارب الأدلة السريرية بفعالية في التنبؤ بخلل وظائف الأعضاء في وحدة العناية المركزة، متفوقاً بذلك على النهج الحالية في مجموعة بيانات MIMIC-DOS المقترحة حديثاً.

Haochen Liu, Weien Li, Rui Song, Zeyu Li, Chun Jason Xue, Xiao-Yang Liu, Sam Nallaperuma, Xue Liu, Ye Yuan2026-04-03
💻 computer science

The Overlooked Repetitive Lengthening Form in Sentiment Analysis

تقدم هذه الورقة مجموعة بيانات "Lenghening" وإطار عمل "ExpInstruct" لمعالجة "نمط الإطالة التكراري" (RLF) المهمل في تحليل المشاعر، مبرهنةً على أن هذا الأسلوب غير الرسمي الفريد يعد مؤشراً هاماً للمشاعر، وأن الضبط الدقيق للتعليمات المكون من مرحلتين يمكن أن يمكّن النماذج اللغوية الكبيرة مفتوحة المصدر من مضاهاة أداء GPT-4 وقدرته على التفسير في هذه المهمة.

Lei Wang, Eduard Dragut2026-04-03
💻 computer science

M2-Verify: A Large-Scale Multidomain Benchmark for Checking Multimodal Claim Consistency

تقدم هذه الورقة البحثية M2-Verify، وهو معيار متعدد الوسائط واسع النطاق ومُتحقق منه من قبل خبراء يمتد عبر 16 مجالاً علمياً بأكثر من 469 ألف حالة، والذي يكشف أن النماذج الحالية المتطورة تعاني في التعامل مع الاتساق المعقد بين الادعاء والأدلة وتهلوس التفسيرات بشكل متكرر رغم أدائها العالي في المهام الأبسط.

Abolfazl Ansari, Delvin Ce Zhang, Zhuoyang Zou, Wenpeng Yin, Dongwon Lee2026-04-03
💻 computer science

Preference learning in shades of gray: Interpretable and bias-aware reward modeling for human preferences

تقترح هذه الورقة إطار عمل لنمذجة المكافأة معززاً بالميزات وقابلاً للتفسير، يدمج إشارات مثل طول الاستجابة والسمية لتحسين دقة تعلم التفضيلات البشرية في النماذج اللغوية بشكل كبير، مع تحليل التحيز وآليات اتخاذ القرار.

Simona-Vasilica Oprea, Adela Bâra2026-04-03
💻 computer science

Procedural Knowledge at Scale Improves Reasoning

تقدم الورقة البحثية "ذاكرة الاستنتاج" (Reasoning Memory)، وهو إطار عمل للجيل المعزز بالاسترجاع يعمل على توسيع نطاق أداء الاستنتاج عبر تفكيك 32 مليون مسار استنتاجي إلى مدخلات معرفية إجرائية قابلة لإعادة الاستخدام، مما يمكّن النماذج من استرجاع وتطبيق الروتينات الفرعية ذات الصلة أثناء الاستدلال للتفوق على النماذج المرجعية الحالية لتوسيع النطاق أثناء الاختبار والجيل المعزز بالاسترجاع (RAG) عبر اختبارات معايير الرياضيات والعلوم والبرمجة.

Di Wu, Devendra Singh Sachan, Wen-tau Yih, Mingda Chen2026-04-03
💻 computer science

Open-Domain Safety Policy Construction

تقدم هذه الورقة البحثية نظام "Deep Policy Research" (DPR)، وهو نظام وكيل أدنى (minimal agentic system) يقوم بصياغة سياسات الإشراف على المحتوى الشاملة ذاتياً من معلومات مجال أولية عبر البحث المتكرر في الويب واستخلاص القواعد، مما يظهر أداءً يتفوق على النماذج المرجعية الحالية وينافس السياسات التي يكتبها الخبراء عبر معايير قياسية متنوعة.

Di Wu, Siyue Liu, Zixiang Ji, Ya-Liang Chang, Zhe-Yu Liu, Andrew Pleffer, Kai-Wei Chang2026-04-03
💻 computer science

Friends and Grandmothers in Silico: Localizing Entity Cells in Language Models

تحدد هذه الورقة وتتحقق من صحة عصبونات (MLP) المتفرقة والقابلة للتأثير السببي في الطبقات المبكرة من النماذج اللغوية، والتي تشفر بشكل انتقائي كيانات محددة، مما يثبت أن تنشيط هذه الخلايا الموضعية يمكن أن يسترجع بشكل موثوق المعرفة الواقعية الخاصة بالكيان ويدعم التنميط القياسي القوي عبر مختلف الأشكال اللغوية.

Itay Yona, Dan Barzilay, Michael Karasik, Mor Geva2026-04-03