💬 NLP

A graph-based analysis of semantic types and coercion in contextualized word embeddings

تقترح هذه الورقة تحليلاً قائماً على الرسوم البيانية باستخدام مقاييس "احتمالية نوع الجار" و"الاعتلاج" (Entropy) على نماذج BERT والتمثيلات الغنية بالمعنى (sense-enhanced embeddings) لإثبات أن معلومات النوع الدلالي وظواهر القسر (coercion) يتم التقاطها بشكل أفضل في النماذج الغنية بالمعنى، مما يتيح التمييز بين أزواج الاسم-السياق المتطابقة وغير المتطابقة.

Long Chen, Deniz Ekin Yavas2026-05-25
💬 NLP

NLG Evaluation: Past, Present, Future

تتتبع هذه الورقة تطور تقييم توليد اللغة الطبيعية (NLG) من أصوله التي ركزت على اللغويات في عام 1990 إلى نموذجه التجريبي الحالي القائم على تعلم الآلة، مع التنبؤ بأن التقييم المستقبلي سيعطي الأولوية بشكل متزايد لمقاييس التأثير، والنوعية، والسلامة مع انتشار تقنية توليد اللغة الطبيعية في كل مكان.

Ehud Reiter2026-05-25
💬 NLP

Decomposing Queries into Tool Calls for Long-Video Keyframe Retrieval

تقدم الورقة البحثية ToolMerge، وهي طريقة مبتكرة لاسترجاع الإطارات الرئيسية تستفيد من نموذج لغوي كبير لتفكيك الاستعلامات إلى استدعاءات أدوات محددة ودمج نتائجها عبر معاملات بولينية، مما يظهر أداءً تنافسيًا على مقياس Molmo-2 Moments المقترح حديثًا.

Michal Shlapentokh-Rothman, Prachi Garg, Yu-Xiong Wang, Derek Hoiem2026-05-25
💬 NLP

Strong Teacher Not Needed? On Distillation in LLM Pretraining

تتحدى هذه الورقة البحثية الاعتقاد السائد بأن تدريب النماذج اللغوية الكبيرة مسبقاً يتطلب معلماً قوياً لضمان فعالية تقطير المعرفة، حيث تثبت أن حتى المعلمين الصغار أو غير المدربين تدريباً كافياً يمكنهم تحسين الطلاب الأكبر حجماً عند خلط دوال الخسارة بشكل مناسب، في حين أن المعلمين الأقوى لا يؤدي وجودهم دائماً إلى نتائج أفضل.

Taiming Lu, Zhuang Liu2026-05-25
💬 NLP

ETCHR: Editing To Clarify and Harness Reasoning

تقدم الورقة البحثية ETCHR، وهو إطار عمل لتحرير الصور يعتمد على الفصل والوعي بالاستدلال، يعمل على سد الفجوة بين الأسئلة المجردة والتحولات البصرية من خلال وصفة تدريب مكونة من مرحلتين، مما يعزز بشكل كبير قدرات الاستدلال البصري لمختلف النماذج اللغوية الكبيرة متعددة الوسائط عبر عائلات مهام متعددة.

Beichen Zhang, Yuhong Liu, Jinsong Li, Yuhang Zang, Jiaqi Wang, Dahua Lin2026-05-25
💬 NLP

Internal narratives parameterise affective states

من خلال دراستين واسعتي النطاق تستخدمان تمثيلات النماذج اللغوية الكبيرة، يوضح هذا البحث أن بنية وديناميكيات السرديات الداخلية لا تتنبأ بشدة الاكتئاب فحسب، بل تؤثر أيضًا بشكل سببي على الحالات الوجدانية، مما يشير إلى أن الوجدان يعمل كحالة حوسبية تقيد بناء السرد وتدمج السياق.

Jakub Onysk, Quentin J. M. Huys2026-05-22
💬 NLP

Evaluating Clinical Competencies of Large Language Models with a General Practice Benchmark

تقدم هذه الورقة البحثية GPBench، وهو معيار تقييم جديد قائم على الكفاءة للممارسة العامة، لتقييم عشرة من النماذج اللغوية الكبيرة المتطورة، وتخلص إلى أن النماذج الحالية ليست مناسبة بعد للنشر السريري المستقل، مما يستلزم إشرافاً بشرياً مستمراً وتحسيناً إضافياً.

Zheqing Li, Yiying Yang, Jiping Lang, Wenhao Jiang, Junrong Chen, Yuhang Zhao, Shuang Li, Dingqian Wang, Zhu Lin, Xuanna (…)2026-05-22
💬 NLP

MTR-Bench: A Comprehensive Benchmark for Multi-Turn Reasoning Evaluation

تقدم هذه الورقة MTR-Bench، وهو معيار شامل ومؤتمت بالكامل يتكون من 40 مهمة و3,600 نموذج مصمم لتقييم قدرات الاستدلال التفاعلي متعدد الجولات لنماذج اللغات الكبيرة، مما يكشف أن حتى النماذج المتطورة تعاني في مثل هذه المهام.

Xiaoyuan Li, Keqin Bao, Yubo Ma, Moxin Li, Wenjie Wang, Rui Men, Yichang Zhang, Fuli Feng, Dayiheng Liu2026-05-22
💬 NLP

Accelerated Test-Time Scaling with Model-Free Speculative Sampling

تقدم الورقة البحثية STAND، وهي طريقة فك تشفير استنتاجي خالية من النماذج (model-free) تستفيد من مسودة N-gram التكيفية العشوائية لاستغلال التكرارات الاستدلالية المتأصلة، محققةً خفضاً بنسبة 60-65% في زمن انتقال الاستدلال عبر مختلف مهام الاستدلال دون المساس بالدقة أو الحاجة إلى تدريب إضافي للنموذج.

Woomin Song, Saket Dingliwal, Sai Muralidhar Jayanthi, Bhavana Ganesh, Jinwoo Shin, Aram Galstyan, Sravan Babu Bodapati2026-05-22