💬 NLP

We can still parse using syntactic rules

يقدم هذا البحث نظام إعراب شفافاً وقابلاً للتفسير يدمج قواعد قواعد النحو الخالي من السياق وقواعد بنية العبارات المعممة للتغلب على القيود التقليدية، مما يولد أشجار تبعية وأشجار تركيبية مع تحمل الضجيج وتحقيق دقة متوسطة في معايير التبعيات العالمية.

Ghaly Hussein2026-02-17
💬 NLP

Detecting LLM Hallucinations via Embedding Cluster Geometry: A Three-Type Taxonomy with Measurable Signatures

تقترح هذه الورقة تصنيفاً هندسياً لـ "هلوسات" النماذج اللغوية الكبيرة إلى ثلاثة أنواع متميزة بناءً على هياكل عناقيد تضمين الرموز (token embedding cluster structures)، وتتحقق من هذا الإطار عبر 11 نموذجاً من نماذج المحولات (transformer models) باستخدام ثلاثة إحصاءات قابلة للقياس (الاقتران القطبي، وتماسك العنقود، وتدرج المعلومات الشعاعي) لتحديد ملفات تعريف الهشاشة المعتمدة على البنية الهندسية.

Matic Korun2026-02-17
💬 NLP

Beyond Token-Level Policy Gradients for Complex Reasoning with Large Language Models

تقترح الورقة البحثية تحسين تدرج السياسة متعدد الرموز (MPO)، وهو إطار عمل يعامل تسلسلات من K من الرموز المتتالية كأفعال دلالية موحدة لتحسين مواءمة تحسين تدرج السياسة مع البنية القائمة على الكتل لمهام الاستدلال المعقدة، مما يظهر أداءً فائقاً على طرق مستوى الرمز القياسية في اختبارات الرياضيات والبرمجة.

Mufan Xu, Kehai Chen, Xuefeng Bai, Zhengyu Niu, Muyun Yang, Tiejun Zhao, Min Zhang2026-02-17
💬 NLP

TruthStance: An Annotated Dataset of Conversations on Truth Social

تقدم هذه الورقة البحثية TruthStance، وهي مجموعة بيانات ضخمة وموسومة بشرياً لمحادثات منصة Truth Social تمتد عبر الفترة من 2023 إلى 2025، والتي تعالج الفجوة في أبحاث خطاب التكنولوجيا البديلة من خلال توفير معايير لاستخراج الحجج وكشف المواقف، جنباً إلى جنب مع تسميات مُولدة بواسطة النماذج اللغوية الكبيرة (LLMs) لإجراء تحليل واسع النطاق للأنماط.

Fathima Ameen, Danielle Brown, Manusha Malgareddy, Amanul Haque2026-02-17
💬 NLP

LLM-Guided Knowledge Distillation for Temporal Knowledge Graph Reasoning

تقترح هذه الورقة إطار عمل لتقطير المعرفة بمساعدة النماذج اللغوية الكبيرة، والذي يستفيد من نموذج لغوي كبير كمعلم مساعد لتعزيز قدرات الاستدلال الزمني للنماذج الطلابية خفيفة الوزن، مما يحقق أداءً فائقاً في التنبؤ بالروابط على الرسوم البيانية للمعرفة الزمنية مع الحفاظ على الكفاءة الحسابية.

Wang Xing, Wei Song, Siyu Lin, Chen Wu, Man Wang2026-02-17
💬 NLP

Selective Synchronization Attention

تقدم هذه الورقة البحثية آلية "انتباه التزامن الانتقائي" (SSA)، وهي آلية انتباه مبتكرة مشتقة من نموذج كوراموتو للمذبذبات المقترنة، والتي تستبدل الانتباه الذاتي القياسي بمؤثر ذي صيغة مغلقة لتحقيق التناثر الطبيعي، والترميز الموحد للموقع والدلالة، والحوسبة الفعالة في تمريرة واحدة ضمن شبكة التزامن التذبذبي (OSN).

Hasi Hays2026-02-17
💬 NLP

Precedent-Informed Reasoning: Mitigating Overthinking in Large Reasoning Models via Test-Time Precedent Learning

تقترح هذه الورقة "الاستدلال المستند إلى السوابق" (PIR)، وهو إطار عمل يخفف من حدة التفكير المفرط غير الفعال في نماذج الاستدلال الكبيرة عبر الاختيار التكيفي للحالات الماضية ذات الصلة واستيعاب أنماط حلها داخلياً عند الاختبار لتقصير مسارات الاستدلال مع الحفاظ على الدقة أو تحسينها.

Qianyue Wang, Jinwu Hu, Huanxiang Lin, Bolin Chen, Zhiquan Wen, Yaofo Chen, Yu Rong, Mingkui Tan2026-02-17
💬 NLP

Robust Bias Evaluation with FilBBQ: A Filipino Bias Benchmark for Question-Answering Language Models

تقدم هذه الورقة FilBBQ، وهو معيار مرجعي للتحيز الفلبيني مكيف ثقافياً يضم أكثر من 10,000 مطالبة، والتي تكشف عند تطبيقها باستخدام بروتوكول تقييم قوي متعدد البذور عن تحيزات جنسانية وعنصرية ضد المثليين كبيرة في نماذج اللغة الفلبينية فيما يتعلق بالعاطفة، والتدبير المنزلي، والاهتمامات الكويرية، وتعدد الزوجات.

Lance Calvin Lim Gamboa, Yue Feng, Mark Lee2026-02-17
💬 NLP

HyperRAG: Reasoning N-ary Facts over Hypergraphs for Retrieval Augmented Generation

يُعد HyperRAG إطار عمل للجيل المعزز بالاسترجاع يستفيد من الرسوم البيانية الفائقة (n-ary hypergraphs) للتغلب على قيود الرسوم البيانية المعرفية الثنائية عبر تقديم HyperRetriever وHyperMemory لضمان استدلال متعدد القفزات يتسم بالتكيف والقابلية للتفسير والكفاءة، محققاً أداءً فائقاً عبر مختلف اختبارات القياس للأسئلة والأجوبة في المجالات المفتوحة والمغلقة.

Wen-Sheng Lien, Yu-Kai Chan, Hao-Lung Hsiao, Bo-Kai Ruan, Meng-Fen Chiang, Chien-An Chen, Yi-Ren Yeh, Hong-Han Shuai2026-02-17
💬 NLP

Is Information Density Uniform when Utterances are Grounded on Perception and Discourse?

تقدم هذه الدراسة أول تحليل حوسبي لفرضية كثافة المعلومات الموحدة في السياقات القائمة على الرؤية، مما يثبت أن ربط اللغة بسياقات إدراكية وسياقات خطابية يزيد باستمرار من انتظام المعلومات عبر لغات متنوعة مقارنة بسيناريوهات النصوص فقط.

Matteo Gay, Coleman Haley, Mario Giulianelli, Edoardo Ponti2026-02-17