💬 NLP

Progressing beyond Art Masterpieces or Touristic Clichés: how to assess your LLMs for cultural alignment?

تتناول هذه الورقة البحثية أوجه القصور في مجموعات البيانات الحالية لتقييم المواءمة الثقافية للنماذج اللغوية الكبيرة من خلال اقتراح مبادئ توجيهية جديدة للتصميم، وبناء مجموعة بيانات مقابلة، وإثبات أن هذا النهج يؤدي، من خلال تجارب مقارنة، إلى نتائج أكثر تمييزاً في التفريق بين النماذج المتخصصة ثقافياً.

António Branco, João Silva, Nuno Marques, Luis Gomes, Ricardo Campos, Raquel Sequeira, Sara Nerea, Rodrigo Silva, Miguel (…)2026-04-29
💬 NLP

LLM-ReSum: A Framework for LLM Reflective Summarization through Self-Evaluation

تقدم هذه الورقة البحثية LLM-ReSum، وهو إطار عمل للتخليص يعتمد على التأمل الذاتي يستفيد من حلقة تغذية راجعة مغلقة بين التوليد والتقييم القائمين على النماذج اللغوية الكبيرة لتحسين الدقة الواقعية والشمولية بشكل كبير دون الحاجة إلى ضبط دقيق للنموذج، مدعوماً بتقييم شامل للمقاييس الحالية ومعيار جديد للوثائق القانونية.

Huyen Nguyen, Haoxuan Zhang, Yang Zhang, Junhua Ding, Haihua Chen2026-04-29
💬 NLP

Modeling Human-Like Color Naming Behavior in Context

تقدم هذه الورقة عملية زيادة عينات المصطلحات اللونية النادرة وتفاعلات التعلم التعزيزي متعددة المستمعين إلى إطار عمل NeLLCom-Lex، مما يثبت أن الجمع بين هذه العوامل والتعلم الخاضع للإشراف ينتج معاجم لونية لوكلاء عصبيين تكون أكثر إخباراً وأكثر تقعراً هندسياً، مما يشبه إلى حد كبير الفئات اللونية البشرية.

Yuqing Zhang, Ecesu Ürker, Tessa Verhoef, Gemma Boleda, Arianna Bisazza2026-04-29
💬 NLP

Cross-Lingual Jailbreak Detection via Semantic Codebooks

تقترح هذه الورقة طريقة للكشف عن كسر الحماية (jailbreak) خالية من التدريب ومستقلة عن اللغة، تقوم بمقارنة تضمينات الاستعلامات متعددة اللغات مقابل كتاب رموز (codebook) إنجليزي ثابت للمطالبات الضارة، وتُظهر أنه في حين أن التشابه الدلالي يحد بفعالية من الهجمات على القوالب النموذجية عبر اللغات، فإن أداءه يتدهور بشكل كبير في ظل تحولات التوزيع التي تنطوي على سلوكيات غير آمنة متنوعة وغير متجانسة.

Shirin Alanova, Bogdan Minko, Sabrina Sadiekh, Evgeniy Kokuykin2026-04-29
💬 NLP

Unrequited Emotions: Investigating the Gaps in Motivation and Practice in Speech Emotion Recognition Research

تحدد هذه الورقة عدم توافق حرجاً بين الدوافع المعلنة وممارسات البحث الفعلية في مجال التعرف على العواطف في الكلام، وتجادل بأن استخدام مجموعات البيانات التي لا تعكس سياقات النشر في العالم الحقيقي يخلق مخاطر أخلاقية ويستلزم تحولاً نحو بحث ملموس مدفوع بحالات الاستخدام.

Taryn Wong, Zeerak Talat, Hanan Aldarmaki, Anjalie Field2026-04-29
💬 NLP

Subliminal Steering: Stronger Encoding of Hidden Signals

تقدم هذه الورقة البحثية "التوجيه اللاشعوري"، وهي تقنية تُثبت إمكانية نقل التحيزات السلوكية المعقدة بدقة وبشكل ميكانيكي من نموذج لغوي معلم إلى نموذج طالب عبر متجه توجيه مُشفّر في بيانات تبدو غير ضارة، مما يكشف أن التحيز والمتجه نفسه قد انتقلا إلى النموذج الطالب.

George Morgulis, John Hewitt2026-04-29
🤖 machine learning

Barriers to Universal Reasoning With Transformers (And How to Overcome Them)

تُظهر هذه المقالة أنه في حين أن نماذج "ترانسفورمر" القياسية القائمة على "سلسلة الأفكار" لا يمكنها التعميم على مسارات الاستدلال الأطول بسبب قيود متأصلة في عمليات النسخ والاسترجاع، إلا أنها يمكنها تحقيق اكتمال تورينج قابل للتعميم من حيث الطول عبر توظيف مفردات متنامية تتضمن رموز "محدد مسار" فريدة وتشفيرات "تغير القيمة" للتغلب على هذه العوائق.

Oliver Kraus, Yash Sarrof, Yuekun Yao, Alexander Koller, Michael Hahn2026-04-29
💬 NLP

PSI-Bench: Towards Clinically Grounded and Interpretable Evaluation of Depression Patient Simulators

تقدم هذه الورقة PSI-Bench، وهو إطار تقييم تلقائي يستند إلى أسس سريرية ويتسم بالقابلية للتفسير، يكشف عن قصور كبير في محاكيات مرضى الاكتئاب الحالية — مثل انخفاض التنوع السلوكي والمسارات العاطفية شديدة التجانس — مع إظهار توافق قوي مع أحكام الخبراء البشريين.

Nguyen Khoi Hoang, Shuhaib Mehri, Tse-An Hsu, Yi-Jyun Sun, Quynh Xuan Nguyen Truong, Khoa D Doan, Dilek Hakkani-Tür2026-04-29
💬 NLP

G-Loss: Graph-Guided Fine-Tuning of Language Models

تقدم هذه الورقة البحثية G-Loss، وهي دالة خسارة موجهة بالرسم البياني تستفيد من انتشار الملصقات شبه الموجه على رسم بياني لتشابه المستندات لالتقاط الهياكل الدلالية العالمية، مما يمكّن النماذج اللغوية من تعلم تمثيلات غنية بالخصائص وتحقيق دقة تصنيف فائقة مقارنة بطرق الضبط الدقيق التقليدية.

Sharma Aditya, Agarwal Vinti, Kumar Rajesh2026-04-29
💬 NLP

From Syntax to Emotion: A Mechanistic Analysis of Emotion Inference in LLMs

تستخدم هذه الورقة البحثية المشفّرات التلقائية المتناثرة (sparse autoencoders) والتتبع السببي (causal tracing) للكشف عن الآليات الداخلية ثلاثية المراحل للتعرف على العواطف في النماذج اللغوية الكبيرة، مما يكشف عن تمثيلات سمات متميزة لمختلف العواطف ويثبت أن توجيه السمات السببية المستهدف يحسن بشكل كبير من أداء التنبؤ بالعواطف مع الحفاظ على القدرات اللغوية.

Bangzhao Shu, Arinjay Singh, Mai ElSherief2026-04-29