💬 NLP

Exploring Novelty Differences between Industry and Academia: A Knowledge Entity-centric Perspective

تستخدم هذه الدراسة نهجاً متمحوراً حول كيانات المعرفة لقياس ومقارنة الحداثة البحثية، كاشفةً أن الأوساط الأكاديمية تنتج عموماً مخرجات ذات حداثة أعلى — لا سيما في براءات الاختراع وقواعد البيانات — بينما يتفوق القطاع الصناعي في التطورات القائمة على مجموعات البيانات ويستفيد بشكل أكبر من التعاون في ابتكار براءات الاختراع.

Hongye Zhao, Yi Zhao, Chengzhi Zhang2026-03-23
🤖 AI

Spectral Tempering for Embedding Compression in Dense Passage Retrieval

تقدم الورقة البحثية تقنية التبريد الطيفي (SpecTemp)، وهي طريقة خالية من التعلم ومستقلة عن النموذج لضغط تضمينات استرجاع الفقرات الكثيفة، حيث تحدد بشكل تكيفي معاملات القياس الطيفي المثلى بناءً على تحليل الإشارة إلى الضوضاء المحلي، مما يحقق أداءً يقارب الأداء الأمثل دون الحاجة إلى بيانات مصنفة أو ضبط للمعلمات الفائقة.

Yongkang Li, Panagiotis Eustratiadis, Evangelos Kanoulas2026-03-23
🤖 machine learning

Anatomical Heterogeneity in Transformer Language Models

تتحدى هذه الورقة البحثية افتراض تجانس الطبقات في النماذج اللغوية القائمة على المحولات (Transformer) من خلال إثبات وجود تباين تشريحي عميق في نموذج SmolLM2-135M، حيث تُظهر الطبقات اختلافاً شاسعاً في الأهمية ومتطلبات التدريب، مما يثبت في النهاية أن إعادة تخصيص الميزانيات الحسابية بناءً على أهمية الطبقة يمكن أن يقلل التكاليف بشكل كبير مع تحسين الأداء.

Tomasz Wietrzykowski2026-03-23
💬 NLP

Scalable Prompt Routing via Fine-Grained Latent Task Discovery

تقترح هذه الورقة بنية توجيه مطالبات ذات مرحلتين وقابلة للتوسع، تستفيد من التجميع القائم على الرسوم البيانية لاكتشاف المهام الكامنة بدقة متناهية ومن نموذج خليط من الخبراء لتقدير الجودة المدرك للمهام، مما يحقق أداءً فائقاً وكفاءة في التكلفة عبر مختلف النماذج الرائدة مقارنة بالنماذج المرجعية الحالية.

Yunyi Zhang, Soji Adeshina, Patrick Guan, Ashwin Ganesh, Zhen Han, Vassilis N. Ioannidis, Huzefa Rangwala, George Karypi (…)2026-03-23
💬 NLP

Is Evaluation Awareness Just Format Sensitivity? Limitations of Probe-Based Evidence under Controlled Prompt Structure

تجادل هذه الورقة بأن الأدلة القائمة على الاختبارات (probe-based evidence) لإدراك التقييم في النماذج اللغوية الكبيرة من المرجح أن تكون مشوشة بسبب هياكل المطالبات السطحية بدلاً من الفهم الحقيقي للسياق، حيث تفشل هذه الإشارات في التعميم على المطالبات ذات الصيغة الحرة عندما يتم التحكم في التنسيق.

Viliana Devbunova2026-03-23
💬 NLP

Vocabulary shapes cross-lingual variation of word-order learnability in language models

تُظهر هذه الدراسة أن بنية مفردات الكلمات والوحدات الفرعية للكلمات، وليس التمايزات التصنيفية الواسعة مثل ترتيب الكلمات الحر مقابل الترتيب الثابت، هي العامل الأساسي الذي يحدد قابلية تعلم تنوعات ترتيب الكلمات في نماذج المحولات اللغوية.

Jonas Mayer Martins, Jaap Jumelet, Viola Priesemann, Lisa Beinborn2026-03-23
💬 NLP

EvidenceRL: Reinforcing Evidence Consistency for Trustworthy Language Models

تقدم الورقة البحثية EvidenceRL، وهو إطار عمل للتعلم التعزيزي يستخدم تحسين السياسة النسبية للمجموعات (GRPO) لفرض الالتزام بالأدلة في النماذج اللغوية الكبيرة، مما يقلل بشكل كبير من الهلوسة ويحسن التأسيس والأمانة في المجالات عالية المخاطر مثل تشخيص أمراض القلب والاستدلال القانوني دون المساس بدقة المهام.

J. Ben Tamo, Yuxing Lu, Benoit L. Marteau, Micky C. Nnamdi, May D. Wang2026-03-23
💬 NLP

TextReasoningBench: Does Reasoning Really Improve Text Classification in Large Language Models?

تقدم الورقة البحثية TextReasoningBench، وهو معيار لتقييم استراتيجيات الاستدلال لتصنيف النصوص عبر عشرة نماذج لغوية كبيرة، والذي يكشف أنه في حين توفر طرق الاستدلال البسيطة مكاسب طفيفة في الدقة، فإن الاستراتيجيات المعقدة غالبًا ما تفشل في التفوق على النماذج المرجعية وتتكبد تكاليف رمزية (tokens) باهظة، مما يتحدى الافتراض بأن الاستدلال الصريح يفيد مهام التصنيف بشكل عالمي.

Xinyu Guo, Yazhou Zhang, Jing Qin2026-03-23
💬 NLP

Structured Prompting for Arabic Essay Proficiency: A Trait-Centric Evaluation Approach

تقدم هذه الورقة إطار عمل مبتكرًا للتلقين ذو بنية ثلاثية المستويات يستفيد من النماذج اللغوية الكبيرة لتحقيق التصحيح الآلي للمقالات المخصص لسمات محددة في اللغة العربية، مما يثبت أن استراتيجيات التلقين الموجهة تتفوق بشكل كبير على حجم النموذج وحده في تقييم سمات الكفاءة اللغوية في مجموعة بيانات QAES الجديدة.

Salim Al Mandhari, Hieu Pham Dinh, Mo El-Haj, Paul Rayson2026-03-23
💬 NLP

DataProphet: Demystifying Supervision Data Generalization in Multimodal LLMs

تقدم الورقة البحثية DATAPROPHET، وهو مقياس لا يتطلب تدريباً يتنبأ بفعالية بأداء التعميم للنماذج اللغوية الكبيرة متعددة الوسائط على المعايير المستهدفة من خلال تحليل تنوع البيانات وتشابهها، مما يثبت أن تشابه المهام الحدسي هو مؤشر غير موثوق وأن هذه الطريقة تتفوق على كل من الاختيار الموحد والأساليب المرجعية المتطورة القائمة على التدريب.

Xuan Qi, Luxi He, Dan Roth, Xingyu Fu2026-03-23