💬 NLP

KGHaluBench: A Knowledge Graph-Based Hallucination Benchmark for Evaluating the Breadth and Depth of LLM Knowledge

تقدم هذه الورقة KGHaluBench، وهو معيار مرجعي جديد قائم على الرسوم البيانية للمعرفة يقوم بتوليد أسئلة متعددة الأوجه ديناميكيًا ويستخدم مسار تحقق آلي لتقييم اتساع وعمق ومصداقية 25 نموذجًا من النماذج اللغوية الكبيرة الرائدة بشكل شامل، مما يوفر رؤى أعمق حول العوامل الدافعة للهلوسة.

Alex Robertson, Huizhi Liang, Mahbub Gani, Rohit Kumar, Srijith Rajamohan2026-02-24
💬 NLP

Denotational Semantics for ODRL: Knowledge-Based Constraint Conflict Detection

تقترح هذه الورقة إطار عمل لدلالات دلالية (denotational semantics) يتيح كشف تعارض ثلاثي القيم سليم لسياسات ODRL عبر قواعد معرفية غير متجانسة من خلال رسم خرائط القيود لمفاهيم قواعد المعرفة، مع إثبات أن التعارضات تظل محفوظة تحت عملية المحاذاة مع التدهور التدريجي للقيم المجهولة، والتحقق من صحة النهج باستخدام 154 معياراً عبر تصنيفات ومجالات هيكلية متنوعة.

Daham Mustafa, Diego Collarana, Yixin Peng, Rafiqul Haque, Christoph Lange-Bever, Christoph Quix, Stephan Decker2026-02-24
💬 NLP

ReAttn: Improving Attention-based Re-ranking via Attention Re-weighting

تقترح هذه الورقة ReAttn، وهي استراتيجية لاحقة (post-hoc) وخالية من التدريب، تعمل على تحسين إعادة الترتيب القائم على الانتباه عبر تطبيق أوزان IDF عبر المستندات لتقليل الانحياز المعجمي، والتنظيم القائم على الإنتروبيا للتخفيف من حدة تركيز الانتباه المفرط، مما يعزز تسجيل الصلة دون إشراف إضافي.

Yuxing Tian, Fengran Mo, Weixu Zhang, Yiyan Qi, Jian-Yun Nie2026-02-24
💬 NLP

Position: General Alignment Has Hit a Ceiling; Edge Alignment Must Be Taken Seriously

تجادل هذه الورقة بأن النموذج الحالي للمحاذاة العامة، الذي يعتمد على صيرورة القيم البشرية المتنوعة في قيم عددية (scalarizing)، قد وصل إلى حد هيكلي في الأنظمة الاجتماعية-التقنية المعقدة، وتقترح "المحاذاة الطرفية" (Edge Alignment) كإطار عمل متفوق يحافظ على هياكل القيم متعددة الأبعاد، ويدعم التمثيل التعددي، ويعامل المحاذاة كدورة حياة حوكمة ديناميكية بدلاً من كونها مهمة تحسين واحدة.

Han Bao, Yue Huang, Xiaoda Wang, Zheyuan Zhang, Yujun Zhou, Carl Yang, Xiangliang Zhang, Yanfang Ye2026-02-24
💬 NLP

Multilingual Large Language Models do not comprehend all natural languages to equal degrees

تتحدى هذه الدراسة الافتراض القائل بأن اللغة الإنجليزية هي اللغة المثلى للنماذج اللغوية الكبيرة من خلال إثبات أنه، بينما تتفوق هذه النماذج على المعايير البشرية بدرجة أقل عبر جميع اللغات المختبرة، فإنها غالباً ما تحقق دقة استيعاب أعلى في بعض اللغات الرومانسية مقارنة باللغة الإنجليزية نتيجة عوامل مثل التجزئة (tokenization)، وتكوين بيانات التدريب، والمسافة اللغوية.

Natalia Moskvina, Raquel Montero, Masaya Yoshida, Ferdy Hubers, Paolo Morosi, Walid Irhaymi, Jin Yan, Tamara Serrano, El (…)2026-02-24
💬 NLP

AdaEvolve: Adaptive LLM Driven Zeroth-Order Optimization

تُعد AdaEvolve إطار عمل هرمي للتحسين التكيفي يستبدل الجداول الزمنية الثابتة بآليات ديناميكية مدفوعة بالنماذج اللغوية الكبيرة لتعديل الاستكشاف، وتوجيه الموارد، وتوليد تكتيكات مبتكرة، مما يؤدي إلى تفوق ملحوظ على النماذج المرجعية الحالية عبر مختلف مشكلات التحسين مفتوحة النهايات.

Mert Cemri, Shubham Agrawal, Akshat Gupta, Shu Liu, Audrey Cheng, Qiuyang Mang, Ashwin Naren, Lutfi Eren Erdogan, Koushi (…)2026-02-24
💬 NLP

Topic Modeling with Fine-tuning LLMs and Bag of Sentences

تقدم هذه الورقة FT-Topic، وهو نهج ضبط دقيق غير خاضع للإشراف يقوم تلقائياً ببناء مجموعات بيانات تدريبية من مجموعات الجمل لتعزيز نمذجة المواضيع القائمة على النماذج اللغوية الكبيرة، مبرهناً على فعاليته من خلال طريقة SenClu المبتكرة والأحدث في هذا المجال.

Johannes Schneider2026-02-23
💬 NLP

FLUKE: A Linguistically-Driven and Task-Agnostic Framework for Robustness Evaluation

تقدم الورقة البحثية FLUKE، وهو إطار عمل مدفوع لغوياً ومستقل عن المهام يستخدم تنوعات محكومة عبر المستويات اللغوية لتقييم متانة النماذج، كاشفاً أن التعديلات الطبيعية السلسة والنفي يشكلان تحديات أكبر من الفساد على المستوى السطحي، وأن قدرات الاستدلال لا ترتبط بالضرورة بتحسن المتانة.

Yulia Otmakhova, Hung Thinh Truong, Rahmad Mahendra, Zenan Zhai, Rongxin Zhu, Daniel Beck, Jey Han Lau2026-02-23
💬 NLP

ConformalNL2LTL: Translating Natural Language Instructions into Temporal Logic Formulas with Conformal Correctness Guarantees

تقترح الورقة البحثية ConformalNL2LTL، وهي طريقة مبتكرة تترجم التعليمات باللغة الطبيعية إلى صيغ المنطق الزمني الخطي (LTL) مع ضمانات صحة محددة من قبل المستخدم عبر الحل التكراري لمشكلات الأسئلة والأجوبة ذات المفردات المفتوحة باستخدام النماذج اللغوية الكبيرة المعززة بالتنبؤ المطابق لتقليل تدخل المستخدم.

David Smith Sundarsingh, Jun Wang, Jyotirmoy V. Deshmukh, Yiannis Kantaros2026-02-23
💬 NLP

Entailed Opinion Matters: Improving the Fact-Checking Performance of Language Models by Relying on their Entailment Ability

تقترح هذه الورقة نموذجاً تعليمياً مبتكراً يستفيد من تصنيف الأدلة والمبررات المستنتجة للنماذج اللغوية التوليدية لتدريب النماذج ذات المشفّر فقط، مما يحسن أداء التحقق من الحقائق بشكل كبير ويظهر متانة عبر مختلف الاستراتيجيات والمجالات.

Gaurav Kumar, Ayush Garg, Debajyoti Mazumder, Aditya Kishore, Babu kumar, Jasabanta Patro2026-02-23