🤖 AI

GraphMERT: Efficient and Scalable Distillation of Reliable Knowledge Graphs from Unstructured Data

تقدم الورقة البحثية GraphMERT، وهو نموذج مدمج وفعال يعتمد على المشفر فقط (encoder-only)، يتغلب على قيود القابلية للتوسع والموثوقية التي تواجهها النماذج اللغوية الكبيرة من خلال استخلاص رسوم بيانية معرفية عالية الجودة، دقيقة واقعياً، ومتسقة مع الأنطولوجيا من النصوص غير المهيكلة، مما يؤسس لإطار عمل عصبي-رمزي قابل للتوسع يتفوق بشكل كبير على النماذج المرجعية الحالية في كل من الدقة والصلاحية الرمزية.

Margarita Belova, Jiaxin Xiao, Shikhar Tuli, Niraj K. Jha2026-03-05
🤖 AI

The Geometry of Reasoning: Flowing Logics in Representation Space

تقترح هذه الورقة إطاراً هندسياً مبتكراً ينمذج استدلال النماذج اللغوية الكبيرة كتدفقات سلسة في فضاء التمثيل، مُثبتةً من خلال تجارب تجريبية أن التنبؤ بالرمز التالي يُمكّن النماذج من استيعاب الثوابت المنطقية كهندسة من رتب عليا، مما يتحدى فرضية "الببغاء العشوائي" ويشير إلى وجود قانون تمثيلي عالمي يكمن وراء الفهم الآلي.

Yufa Zhou, Yixiao Wang, Xunjian Yin, Shuyan Zhou, Anru R. Zhang2026-03-05
💬 NLP

Annotation-Efficient Universal Honesty Alignment

تقدم هذه الورقة EliCal، وهو إطار عمل ثنائي المرحلة كفء في التوسيم، يجمع بين استثارة الاتساق الذاتي غير المكلفة والحد الأدنى من تسمية الصحة لتحقيق محاذاة أمانة شاملة في النماذج اللغوية الكبيرة، والتي تم التحقق من صحتها بواسطة معيار HonestyBench الصادر حديثاً.

Shiyu Ni, Keping Bi, Jiafeng Guo, Minghao Tang, Jingtong Wu, Zengxin Han, Xueqi Cheng2026-03-05
💬 NLP

Citation Failure: Definition, Analysis and Efficient Mitigation

تقدم هذه الورقة معيار CITECONTROL لتحليل إخفاقات الاستشهاد في أنظمة RAG القائمة على النماذج اللغوية الكبيرة (LLM) بشكل منهجي، وتقترح إطار العمل الهجين CITENTION الذي يخفف من هذه الإخفاقات بفعالية من خلال دمج الأساليب التوليدية، والقائمة على الانتباه، والقائمة على الاسترجاع.

Jan Buchmann, Iryna Gurevych2026-03-05
🤖 AI

CareMedEval dataset: Evaluating Critical Appraisal and Reasoning in the Biomedical Field

تقدم الورقة البحثية CareMedEval، وهي مجموعة بيانات مبتكرة مستمدة من امتحانات طلاب الطب الفرنسيين، والتي تقيم قدرة النماذج اللغوية الكبيرة على إجراء التقييم النقدي والاستدلال على الأدبيات الطبية الحيوية، مما يكشف عن قصور كبير في النماذج الحالية رغم التحسينات الناتجة عن خطوات الاستدلال المتوسطة.

Doria Bonzi, Alexandre Guiggi, Frédéric Béchet, Carlos Ramisch, Benoit Favre2026-03-05
🤖 AI

Multimodal Large Language Models for Low-Resource Languages: A Case Study for Basque

تقدم هذه الورقة دراسة حالة حول تطوير نموذج لغوي كبير متعدد الوسائط للغة الباسكية ذات الموارد المنخفضة، مما يثبت إمكانية تحقيق أداء قوي باستخدام ما يقرب من 20% فقط من البيانات متعددة الوسائط للغة الباسكية، وأن وجود نموذج لغوي أساسي مكيف للغة الباسكية ليس ضروريًا بشكل صارم.

Lukas Arana, Julen Etxaniz, Ander Salaberria, Gorka Azkune2026-03-05
💬 NLP

Dripper: Token-Efficient Main HTML Extraction with a Lightweight LM

تقدم هذه الورقة Dripper، وهو إطار عمل خفيف الوزن يعيد صياغة استخراج المحتوى الرئيسي للويب كمسألة وسم تسلسلي مقيدة باستخدام النماذج اللغوية الصغيرة، محققاً كفاءة ودقة متفوقتين مقارنة بكل من القواعد الاستدلالية التقليدية والنماذج اللغوية الكبيرة التوليدية الضخمة، مع تمكين إنشاء مجموعات بيانات تدريبية عالية الجودة.

Mengjie Liu, Jiahui Peng, Wenchang Ning, Pei Chu, Jiantao Qiu, Ren Ma, He Zhu, Rui Min, Lindong Lu, Linfeng Hou, Kaiwen (…)2026-03-05
🤖 AI

NRR-Core: Non-Resolution Reasoning as a Computational Framework for Contextual Identity and Ambiguity Preservation

تقترح هذه الورقة "الاستدلال غير الحاسم" (NRR)، وهو إطار حوسبي مبتكر يتحدى الانهيار المبكر للغموض في الذكاء الاصطناعي الحالي عبر إدخال مبادئ عدم الهوية والاحتفاظ بالتفسير المتوازي للحفاظ على الهوية السياقية والإبقاء على معانٍ متعددة صالحة حتى تقتضي الضرورة الحسم صراحةً.

Kei Saito2026-03-05
🤖 AI

A Systematic Analysis of Biases in Large Language Models

تقيم هذه الدراسة بشكل منهجي أربعة من النماذج اللغوية الكبيرة واسعة الانتشار عبر الأبعاد السياسية، والأيديولوجية، والتحالفية، واللغوية، والجنسانية، كاشفةً أنه على الرغم من جهود المواءمة من أجل الحياد، لا تزال هذه النماذج تظهر تحيزات وتآلفات كبيرة.

Xulang Zhang, Rui Mao, Erik Cambria2026-03-05
🤖 AI

Succeeding at Scale: Automated Dataset Construction and Query-Side Adaptation for Multi-Tenant Search

تقدم هذه الورقة DevRev-Search، وهو معيار مؤتمت لاسترجاع الدعم الفني، وتقترح استراتيجية التكيف الحافظ للفهرس (Index-Preserving Adaptation) التي تعمل على ضبط مشفر الاستعلام فقط لتحقيق بحث متعدد المستأجرين عالي الأداء وقابل للتوسع دون التكلفة الباهظة لإعادة الفهرسة.

Prateek Jain, Shabari S Nair, Ritesh Goru, Prakhar Agarwal, Ajay Yadav, Yoga Sri Varshan Varadharajan, Constantine Caram (…)2026-03-05