💬 NLP

RELIC: Evaluating Complex Reasoning via the Recognition of Languages In-Context

تقدم الورقة البحثية RELIC، وهو إطار عمل لتقييم الاستدلال المعقد للنماذج اللغوية الكبيرة من خلال اختبار قدرتها على التعرف على اللغات الخالية من السياق ضمن السياق، مما يكشف أن حتى النماذج المتقدمة تفشل في رفع قدرة الحوسبة الاستنتاجية مع زيادة صعوبة المهمة وغالباً ما تتحول من الاستدلال الخوارزمي إلى التخمين مع زيادة التعقيد.

Jackson Petty, Michael Y. Hu, Wentao Wang, Shauli Ravfogel, William Merrill, Tal Linzen2026-04-29
💬 NLP

Is Large Language Model Performance on Reasoning Tasks Impacted by Different Ways Questions Are Asked?

تكشف هذه الدراسة أن صيغة الأسئلة، بما في ذلك عدد الخيارات وصياغة محددة، تؤثر بشكل كبير على أداء النماذج اللغوية الكبيرة في مهام الاستدلال، مما يتسبب غالباً في حدوث انفصال بين دقة خطوات الاستدلال وصحة الإجابة النهائية.

Seok Hwan Song, Mohna Chakraborty, Qi Li, Wallapak Tavanapong2026-04-29
💬 NLP

Named Entity Recognition of Historical Texts via Large Language Model

تُظهر هذه الدراسة أن النماذج اللغوية الكبيرة، من خلال استخدام استراتيجيات التلقين بـ "الصفر محاولة" (zero-shot) و"القليل من الأمثلة" (few-shot)، توفر بديلاً فعالاً ومجدياً لتعرّف الكيانات المسماة في النصوص التاريخية حيث تندر بيانات التدريب المُصنفة، محققةً أداءً قوياً إلى حد معقول رغم عدم وصولها إلى مستوى النماذج الخاضعة للإشراف الكامل.

Shibingfeng Zhang, Giovanni Colavizza2026-04-29
💬 NLP

Beyond I'm Sorry, I Can't: Dissecting Large Language Model Refusal

تستقصي هذه الورقة الآليات الداخلية للرفض في النماذج اللغوية الكبيرة المضبوطة للتعليمات من خلال تدريب المشفّرات التلقائية المتناثرة لتحديد واستئصال سمات كامنة محددة تقلب النموذج سببياً من الرفض إلى الامتثال، مما يكشف عن مسار متعدد المراحل لكسر الحماية ويسلط الضال على وجود ميزات سلامة فائضة عن الحاجة.

Nirmalendu Prakash, Yeo Wei Jie, Amir Abdullah, Ranjan Satapathy, Erik Cambria, Roy Ka Wei Lee2026-04-29
💬 NLP

The Unheard Alternative: Contrastive Explanations for Speech-to-Text Models

تقدم هذه المساهمة أول طريقة لتوليد تفسيرات تباينية في نماذج تحويل الكلام إلى نص من خلال تحليل كيفية تأثير ميزات المخطط الطيفي للمدخلات على الاختيار بين المخرجات البديلة، وتثبت فعاليتها من خلال دراسة حالة حول تحديد النوع الاجتماعي في ترجمة الكلام.

Lina Conti, Dennis Fucci, Marco Gaido, Matteo Negri, Guillaume Wisniewski, Luisa Bentivogli2026-04-29
💬 NLP

From Local to Global: Revisiting Structured Pruning Paradigms for Large Language Models

تقدم هذه الورقة GISP، وهي طريقة تقليم هيكلي تكراري عالمية تجمع درجات الأهمية القائمة على الخسارة من الدرجة الأولى لتجميع رؤوس الانتباه وقنوات MLP بكفاءة، مما يتفوق بذلك على النماذج المحلية التقليدية عبر تثبيت الدقة عند مستويات التشتت العالية وتمكين التحسين الخاص بمهمة معينة دون الحاجة إلى ضبط دقيق وسيط.

Ziyan Wang, Enmao Diao, Qi Le, Pu Wang, Minwoo Lee, Shu-ping Yeh, Evgeny Stupachenko, Hao Feng, Li Yang2026-04-29
💬 NLP

Rating Roulette: Self-Inconsistency in LLM-As-A-Judge Frameworks

تكشف هذه الورقة أن الحكام القائمين على النماذج اللغوية الكبيرة يظهرون عدم اتساق ملحوظاً في التقييم داخل نفس المُقيّم عبر عمليات تشغيل مختلفة، مما يقوض موثوقية درجاتهم، وتستقصي ما إذا كان يمكن استغلال مثل هذه التقييمات بفعالية من خلال إرشادات محددة.

Rajarshi Haldar, Julia Hockenmaier2026-04-29
💬 NLP

MiMo-Embodied: X-Embodied Foundation Model Technical Report

تقدم الورقة البحثية MiMo-Embodied، وهو أول نموذج تأسيسي مفتوح المصدر عابر للأجساس (cross-embodied) يحقق أداءً هو الأفضل في مجاله في كل من القيادة الذاتية والذكاء الاصطناي المادي (embodied AI) عبر الاستفادة من التعلم متعدد المراحل، والبيانات المنسقة، والضبط الدقيق باستخدام سلسلة الأفكار (CoT) والتعلم المعزز (RL) لإظهار انتقال إيجابي قوي بين هذين المجالين.

Xiaoshuai Hao, Lei Zhou, Zhijian Huang, Zhiwen Hou, Yingbo Tang, Lingfeng Zhang, Guang Li, Zheng Lu, Shuhuai Ren, Xianhu (…)2026-04-29
💬 NLP

Voice, Bias, and Coreference: An Interpretability Study of Gender in Speech Translation

تتقصى هذه الدراسة كيفية تخصيص نماذج الترجمة الشفهية للجنس القواعدي للمصطلحات التي تشير إلى المتحدث، من خلال الكشف عن أنه في حين تُظهر النماذج اللغوية الداخلية انحيازاً ذكورياً، فإن النماذج عالية الأداء يمكنها تجاوز ذلك باستخدام الإشارات الصوتية وآلية مبتكرة تربط ضمائر المتكلم بالمصطلحات المحددة جنسياً عبر معلومات طيف التردد الموزعة بدلاً من مجرد طبقة الصوت.

Lina Conti, Dennis Fucci, Marco Gaido, Matteo Negri, Guillaume Wisniewski, Luisa Bentivogli2026-04-29
💬 NLP

Limited Linguistic Diversity in Embodied AI Datasets

تقدم هذه الورقة تدقيقاً منهجياً لمجموعات بيانات الرؤية واللغة والعمل (VLA) واسعة الاستخدام، كاشفةً أنها تعتمد بشكل أساسي على تعليمات تكرارية ونمطية ذات تنوع لغوي محدود، مما يسلط الضرض على الحاجة إلى تنسيق وتقارير أكثر منهجية لمجموعات البيانات من أجل توسيع نطاق التغطية اللغوية.

Selma Wanna, Agnes Luhtaru, Jonathan Salfity, Ryan Barron, Juston Moore, Cynthia Matuszek, Mitch Pryor2026-04-29