💻 computer science

LLMORPH: Automated Metamorphic Testing of Large Language Models

تقدم هذه الورقة LLMORPH، وهي أداة اختبار تحولي مؤتمتة تقيم متانة النماذج اللغوية الكبيرة عبر مختلف مهام معالجة اللغات الطبيعية من خلال توليد مدخلات متابعة عبر علاقات تحولية للكشف عن عدم اتساق المخرجات دون الاعتماد على بيانات مصنفة بشرياً.

Steven Cho, Stefano Ruberto, Valerio Terragni2026-03-26
💬 NLP

Revisiting Real-Time Digging-In Effects: No Evidence from NP/Z Garden-Paths

من خلال تجربتين تقارنان السلوك البشري مع النماذج اللغوية الكبيرة في جمل "المسار الحدي" (garden-path) ذات العبارات الاسمية/الزائدة، تجد هذه الدراسة عدم وجود دليل على تأثيرات "التشبث بالرأي" (digging-in) في الوقت الفعلي، مما يشير إلى أن الاتجاهات الملحوظة سابقاً هي على الأرجح نتاج لعمليات التلخيص النهائي للجملة بدلاً من كونها تعزيزاً حقيقياً للالتزامات الهيكلية أثناء المعالجة الآنية.

Amani Maina-Kilaas, Roger Levy2026-03-26
💬 NLP

The Diminishing Returns of Early-Exit Decoding in Modern LLMs

تُظهر هذه الورقة أن تقنية فك التشفير عبر الخروج المبكر، وهي تقنية لتقليل زمن الاستجابة وتكلفة الاستدلال في النماذج اللغوية الكبيرة، أصبحت غير فعالة بشكل متزايد في النماذج الحديثة بسبب انخفاض تكرار الطبقات، حيث تحتفظ النماذج الأساسية الكثيفة وواسعة النطاق بإمكانات أكبر للخروج المبكر مقارنة بنماذج خليط الخبراء أو نماذج فضاء الحالة.

Rui Wei, Rui Du, Hanfei Yu, Devesh Tiwari, Jian Li, Zhaozhuo Xu, Hao Wang2026-03-26
💬 NLP

Perturbation: A simple and efficient adversarial tracer for representation learning in language models

تقدم هذه الورقة البحثية "الاضطراب" (Perturbation)، وهي طريقة بسيطة وفعالة لتحديد التمثيلات اللغوية في النماذج اللغوية من خلال ضبطها بدقة على مثال عدائي واحد وقياس "العدوى" الناتجة عبر المدخلات الأخرى، مما يتجاوز الحاجة إلى الافتراضات الهندسية المقيدة مع الكشف عن التعميم والتجريد المهيكلين.

Joshua Rozner, Cory Shain2026-03-26
💬 NLP

How Vulnerable Are Edge LLMs?

تُثبت هذه الورقة أن التكميم وحده يفشل في حماية النماذج اللغوية الكبيرة المنشورة على الحافة من هجمات استخراج المعرفة، حيث تقدم إطار عمل CLIQ لاستعادة المعلومات الدلالية من النماذج المكممة بشكل منهجي وبكفاءة أكبر من طرق الاستعلام القياسية.

Ao Ding, Hongzong Li, Zi Liang, Zhanpeng Shi, Shuxin Zhuang, Shiqin Tang, Rong Feng, Ping Lu2026-03-26
💬 NLP

Self-Distillation for Multi-Token Prediction

تقترح هذه الورقة MTP-D، وهي طريقة تقطير ذاتي تعتمد على استراتيجية تمديد حلقية تعمل على تحسين معدلات قبول التنبؤ متعدد الرموز وسرعة الاستدلال بشكل كبير مع الحفاظ على أداء الرأس الرئيسي في النماذج اللغوية الكبيرة.

Guoliang Zhao, Ruobing Xie, An Wang, Shuaipeng Li, Huaibing Xie, Xingwu Sun2026-03-26
💬 NLP

Thinking with Tables: Enhancing Multi-Modal Tabular Understanding via Neuro-Symbolic Reasoning

تقدم هذه الورقة البحثية "التفكير مع الجداول" (TWT)، وهو إطار عمل للاستدلال العصبي الرمزي يستفيد من البرمجة المعتمدة على الكود لمعالقة التحديات الهيكلية وتحديات التبعية في البيانات الجدولية، متفوقاً بشكل كبير على النماذج المرجعية الحالية ومنافسًا للنماذج المملوكة في مهام الفهم متعدد الوسائط للجداول.

Kun-Yang Yu, Zhi Zhou, Shi-Yu Tian, Xiao-Wen Yang, Zi-Yi Jia, Ming Yang, Zi-Jian Cheng, Lan-Zhe Guo, Yu-Feng Li2026-03-26
💬 NLP

CVPD at QIAS 2026: RAG-Guided LLM Reasoning for Al-Mawarith Share Computation and Heir Allocation

تقدم الورقة البحثية مساراً للتوليد المعزز بالاسترجاع (RAG) يجمع بين البيانات الاصطناعية القائمة على القواعد، والاسترجاع الهجين مع إعادة ترتيب باستخدام المشفر المتقاطع، والتحقق المقيد بالمخطط (schema) لتحقيق أداء رائد في حساب حصص الميراث الإسلامي وتوزيعها على الورثة، مما ضمن المركز الأول في لوحة صدارة مسابقة QIAS 2026.

Wassim Swaileh, Mohammed-En-Nadhir Zighem, Hichem Telli, Salah Eddine Bekhouche, Abdellah Zakaria Sellam, Fadi Dornaika (…)2026-03-26
💬 NLP

Schema on the Inside: A Two-Phase Fine-Tuning Method for High-Efficiency Text-to-SQL at Scale

تقدم هذه الورقة نموذجاً متخصصاً بـ 8 مليارات معلمة (8B-parameter) لنظام Dream11 البيئي، يحقق أداءً عالي الدقة ومنخفض التأخير في تحويل النص إلى استعلام SQL (Text-to-SQL) عبر استخدام طريقة ضبط دقيق مبتكرة ثنائية المراحل لاستيعاب مخطط قاعدة البيانات داخلياً، مما أدى إلى تقليل رموز الإدخال (input tokens) بنسبة تزيد عن 99% والتفوق على النماذج المملوكة القائمة على واجهات برمجة التطبيقات (API-based) ذات الحالة الراهنة في بيئة إنتاج واسعة النطاق.

Chinmay Soni, Shivam Chourasia, Gaurav Kumar, Hitesh Kapoor2026-03-26
💬 NLP

ConceptKT: A Benchmark for Concept-Level Deficiency Prediction in Knowledge Tracing

تقدم هذه الورقة ConceptKT، وهو معيار ومجموعة بيانات جديدة مصممة لتطوير تتبع المعرفة من خلال تمكين التنبؤ بنقص مفاهيمي محدد عبر تقييم النماذج اللغوية الكبيرة والنماذج الاستدلالية الكبيرة باستخدام استراتيجيات التعلم في السياق القائمة على التوافق المفاهيمي والتشابه الدلالي.

Yu-Chen Kang, Yu-Chien Tang, An-Zi Yen2026-03-26