💬 NLP

Scalable Prompt Routing via Fine-Grained Latent Task Discovery

تقترح هذه الورقة بنية توجيه مطالبات ذات مرحلتين وقابلة للتوسع، تستفيد من التجميع القائم على الرسوم البيانية لاكتشاف المهام الكامنة بدقة متناهية ومن نموذج خليط من الخبراء لتقدير الجودة المدرك للمهام، مما يحقق أداءً فائقاً وكفاءة في التكلفة عبر مختلف النماذج الرائدة مقارنة بالنماذج المرجعية الحالية.

Yunyi Zhang, Soji Adeshina, Patrick Guan, Ashwin Ganesh, Zhen Han, Vassilis N. Ioannidis, Huzefa Rangwala, George Karypi (…)2026-03-23
💬 NLP

Is Evaluation Awareness Just Format Sensitivity? Limitations of Probe-Based Evidence under Controlled Prompt Structure

تجادل هذه الورقة بأن الأدلة القائمة على الاختبارات (probe-based evidence) لإدراك التقييم في النماذج اللغوية الكبيرة من المرجح أن تكون مشوشة بسبب هياكل المطالبات السطحية بدلاً من الفهم الحقيقي للسياق، حيث تفشل هذه الإشارات في التعميم على المطالبات ذات الصيغة الحرة عندما يتم التحكم في التنسيق.

Viliana Devbunova2026-03-23
💬 NLP

Vocabulary shapes cross-lingual variation of word-order learnability in language models

تُظهر هذه الدراسة أن بنية مفردات الكلمات والوحدات الفرعية للكلمات، وليس التمايزات التصنيفية الواسعة مثل ترتيب الكلمات الحر مقابل الترتيب الثابت، هي العامل الأساسي الذي يحدد قابلية تعلم تنوعات ترتيب الكلمات في نماذج المحولات اللغوية.

Jonas Mayer Martins, Jaap Jumelet, Viola Priesemann, Lisa Beinborn2026-03-23
💬 NLP

EvidenceRL: Reinforcing Evidence Consistency for Trustworthy Language Models

تقدم الورقة البحثية EvidenceRL، وهو إطار عمل للتعلم التعزيزي يستخدم تحسين السياسة النسبية للمجموعات (GRPO) لفرض الالتزام بالأدلة في النماذج اللغوية الكبيرة، مما يقلل بشكل كبير من الهلوسة ويحسن التأسيس والأمانة في المجالات عالية المخاطر مثل تشخيص أمراض القلب والاستدلال القانوني دون المساس بدقة المهام.

J. Ben Tamo, Yuxing Lu, Benoit L. Marteau, Micky C. Nnamdi, May D. Wang2026-03-23
💬 NLP

TextReasoningBench: Does Reasoning Really Improve Text Classification in Large Language Models?

تقدم الورقة البحثية TextReasoningBench، وهو معيار لتقييم استراتيجيات الاستدلال لتصنيف النصوص عبر عشرة نماذج لغوية كبيرة، والذي يكشف أنه في حين توفر طرق الاستدلال البسيطة مكاسب طفيفة في الدقة، فإن الاستراتيجيات المعقدة غالبًا ما تفشل في التفوق على النماذج المرجعية وتتكبد تكاليف رمزية (tokens) باهظة، مما يتحدى الافتراض بأن الاستدلال الصريح يفيد مهام التصنيف بشكل عالمي.

Xinyu Guo, Yazhou Zhang, Jing Qin2026-03-23
💬 NLP

Structured Prompting for Arabic Essay Proficiency: A Trait-Centric Evaluation Approach

تقدم هذه الورقة إطار عمل مبتكرًا للتلقين ذو بنية ثلاثية المستويات يستفيد من النماذج اللغوية الكبيرة لتحقيق التصحيح الآلي للمقالات المخصص لسمات محددة في اللغة العربية، مما يثبت أن استراتيجيات التلقين الموجهة تتفوق بشكل كبير على حجم النموذج وحده في تقييم سمات الكفاءة اللغوية في مجموعة بيانات QAES الجديدة.

Salim Al Mandhari, Hieu Pham Dinh, Mo El-Haj, Paul Rayson2026-03-23
💬 NLP

DataProphet: Demystifying Supervision Data Generalization in Multimodal LLMs

تقدم الورقة البحثية DATAPROPHET، وهو مقياس لا يتطلب تدريباً يتنبأ بفعالية بأداء التعميم للنماذج اللغوية الكبيرة متعددة الوسائط على المعايير المستهدفة من خلال تحليل تنوع البيانات وتشابهها، مما يثبت أن تشابه المهام الحدسي هو مؤشر غير موثوق وأن هذه الطريقة تتفوق على كل من الاختيار الموحد والأساليب المرجعية المتطورة القائمة على التدريب.

Xuan Qi, Luxi He, Dan Roth, Xingyu Fu2026-03-23
💬 NLP

TAB-AUDIT: Detecting AI-Fabricated Scientific Tables via Multi-View Likelihood Mismatch

تقدم هذه الورقة البحثية إطار عمل TAB-AUDIT، وأول مجموعة بيانات مرجعية (FabTab) للكشف عن الجداول العلمية المصنعة بواسطة الذكاء الاصطناعي من خلال الاستفستادة من عدم التوافق في احتمالية ما بين هياكل الجداول والمحتوى الرقمي، محققةً أداءً هو الأفضل حالياً في تحديد الاحتيال الأكاديمي.

Shuo Huang, Yan Pen, Lizhen Qu2026-03-23
🤖 machine learning

Dual Path Attribution: Efficient Attribution for SwiGLU-Transformers through Layer-Wise Target Propagation

تقدم هذه الورقة البحثية "العزو ثنائي المسار" (DPA)، وهو إطار عمل فعال وأمين يتتبع تدفق المعلومات في نماذج المحولات القائمة على SwiGLU من خلال تمريرة أمامية وعكسية واحدة بتعقيد O(1)O(1)، محققاً أداءً هو الأفضل حالياً في معايير التفسير دون الحاجة إلى أمثلة مضادة للواقع.

Lasse Marten Jantsch, Dong-Jae Koh, Seonghyeon Lee, Young-Kyoon Suh2026-03-23
💬 NLP

Neither Here Nor There: Cross-Lingual Representation Dynamics of Code-Mixed Text in Multilingual Encoders

تتقصى هذه الورقة ديناميكيات التمثيل الداخلي للنصوص المختلطة لغوياً في المشفرات متعددة اللغات باستخدام الهندية-الإنجليزية كدراسة حالة، كاشفةً أن النماذج القياسية تعالج مثل هذه المدخلات من خلال فضاء فرعي يهيمن عليه الإنجليزية، ومقترحةً هدف محاذاة ما بعد التدريب ثلاثي اللغات يوازن بنجاح بين الروابط عبر اللغات لتحسين أداء المهام اللاحقة.

Debajyoti Mazumder, Divyansh Pathak, Prashant Kodali, Jasabanta Patro2026-03-23