💬 NLP

Persona-Guided LLM Agents for Task-Oriented Dialogue

تقدم هذه الورقة إطار عمل لا يتطلب تدريباً يثبت أن وكلاء النماذج اللغوية الكبيرة يمكنهم التكيف بفعالية مع شخصيات المستخدمين في الحوارات الموجهة نحو المهام لتحسين الرضا وإنجاز المهام، بينما تكشف عن وجود مقايضة مع الصدقية تُحل بشكل أفضل من خلال التكيف القائم على الإشارات بدلاً من المعرفة الصريحة.

Maryam Shoaeinaeini, Brent Harrison, A. B. Siddique2026-08-20
💬 NLP

SuTRA : Structurally-Unified Tokenization with Root Awareness

تقدم الورقة البحثية SuTRA، وهي خوارزمية تقسيم رموز مدركة للمورفولوجيا مصممة للغات الهندية تحافظ على هياكل الجذر واللواحق وعدم قابلية تقسيم الـ "أكشارا" للتغلب على "التفتت المورفولوجي" للطرق الحالية، مما يؤدي إلى تحسينات كبيرة في المحاذاة المورفولوجية، والقدرة على استعادة المعنى، وأداء الترجمة الآلية.

Vaibhav Rathore, Siddhant Gole, Dadhichi Telwadkar, Rooshil Bhatia, Maulik Ruparel, Siddharth Surekha, Neha Bhargava2026-08-20
💬 NLP

Latent Space Refusal Anchoring for Low-Resource African Languages: Mechanistic Safety Recovery Without Retraining

تقدم هذه الورقة البحثية تقنية "تثبيت الرفض في الفضاء الكامن" (LSR-Anchoring)، وهي طريقة لا تتطلب تدريباً تعمل على استعادة الرفض الأمني في اللغات الأفريقية ذات الموارد المنخفضة من خلال استخراج اتجاهات الرفض من اللغة الإنجليزية وتطبيقها على التدفق المتبقي عند الاستدلال، محققةً استعادة أمنية فعالة مع أدنى قدر من تدهور الأداء عبر تقنيات مثل "التوجيه المستمد من تحليل المكونات المستقلة" (SAE-Derived Steering).

Godwin Abuh Faruna2026-08-20
💬 NLP

Nine Emotion Centroids: A Label-Free Valence Axis That Transfers Across Four Modalities

تُثبت هذه الورقة أن "محور التكافؤ" (valence axis) منفردًا، يتم استخلاصه بكفاءة عالية في استخدام الملصقات من تسع فئات عاطفية فقط وسرديات قصيرة، يمكن استخراجه من النماذج اللغوية المجمدة ونقله بنجاح إلى مشفرات الرؤية والصوت والدماغ للتنبؤ بالمشاعر بدقة عالية، شريطة أن تكون المفاهيم المستهدفة مستمرة وليست فئوية.

Yousef Radwan2026-08-20
💬 NLP

Self- and Other-Labels Induce Bidirectional Bias in LLM Judges

تُبين هذه الورقة أنه بينما يتلاشى التفضيل الذاتي الحقيقي في أحكام النماذج اللغوية الكبيرة إلى حد كبير عند ضبط جودة المخرجات، فإن مجرد وجود تسميات "الذات" أو "الآخر" يستحث انحيازاً ثنائي الاتجاه يؤدي إلى تضخيم الدرجات للمحتوى المصنف كذاتي وخفضها للمحتوى المصنف كآخر، مما يكشف أن عزو المؤلفية يعد دافعاً متميزاً لانحياز التقييم.

Songeun Chae, Min Kim, Donghoon Jung, Seojin Choi, Seohyon Jung2026-08-20
💬 NLP

Abliteration Mitigation via Refusal Aliases

تقدم هذه الورقة AMRA، وهو دفاع يعتمد على تحرير الأوزان يعمل على تخفيف هجمات "الاستئصال" (abliteration) من خلال إخفاء اتجاه الرفض عبر تحديثات الرتبة-kk والتحويل التزييفي للتنشيط (activation aliasing)، مما يحسن بشكل كبير من الاحتفاظ بالرفض في نموذجي Llama-3-8B وGemma-2-9B مع تأثير ضئيل على فائدة النموذج.

Nathan Truong2026-08-20
💬 NLP

NE-BERT: A Multilingual Language Model for Nine Northeast Indian Languages

تقدم الورقة البحثية نموذج NE-BERT، وهو نموذج لغوي متعدد اللغات تم تدريبه على 8.3 مليون جملة عبر تسع لغات من شمال شرق الهند ولغتين مرجعيتين، والذي يتفوق بشكل كبير على النماذج الحالية مثل IndicBERT-V2 وMuRIL في مستويات الحيرة وكفاءة التجزئة مع معالجة مشكلة تفتت المفردات الحرجة في اللغات ذات الموارد المنخفضة.

Badal Nyalang2026-08-20
💬 NLP

FrenchNews-7: Benchmarking Cross-Publisher French News Editorial Desk Classification

تقدم هذه الورقة البحثية FrenchNews-7، وهو معيار جديد لتصنيف المقالات الإخبارية الفرنسية إلى سبع فئات تحريرية عبر ناشرين متعددين، والذي يثبت أن نموذج CamemBERT الذي تم ضبطه بدقة يتفوق على النماذج اللغوية الكبيرة ذات التعلم الصفري، ويكشف أن أداء التصنيف يتباين بشكل كبير حسب الفئة، حيث تقترب المجالات الغامضة مثل "الاقتصاد" و"المجتمع" من حدود الاتفاق البشري.

Amr Sobhy2026-08-20
💬 NLP

Computational Orientalism: Measuring Structural Discourse Bias in Large Language Models Using the Middle East Cultural Sensitivity Score (MECSS)

تقدم هذه الورقة "مقياس الحساسية الثقافية للشرق الأوسط" (MECSS) لتوضيح أن النماذج اللغوية الكبيرة، بما في ذلك تلك التي تم تطويرها في الشرق الأوسط، تعيد إنتاج التحيزات الاستشراقية الهيكلية بشكل منهجي من خلال "التبيئة السعيدية" (Said-washing) وتأطير المعرفة الغربية كمعرفة عالمية، مما يكشف عن فشل مقاييس العدالة القياسية في اكتشاف هذه التشوهات المعرفية العميقة.

Maha Shahid2026-08-20