💬 NLP

ConRub-Med: Reinforcement Learning with Consensus Rubrics for Open-Ended Medical Question Answering

يُعد ConRub-Med إطاراً للتعلم التعزيزي للإجابة المفتوحة على الأسئلة الطبية، وهو يستخدم معايير تقييم مولدة بواسطة النماذج وقائمة على الإجماع ونظام تسجيل متخصص ثلاثي الحالات لتحقيق أداء رائد عبر معايير قياسية متعددة مع تقليل الاعتماد على التحقق الخبير المكلف.

Taojie Zhu, Yuan Xia, Tao Sun, Yizhi Wang, Yan Chen, Qunshan He, Tian Guan, Jian Wang, Jinjie Gu, Junwei Liu, Yonghong H (…)2026-08-12
💬 NLP

Data Attribution of Emergent Misalignment with Persona Features

تحدد هذه الورقة أن عدم الاتساق الناشئ في النماذج اللغوية مدفوع بتضخيم "سمات شخصية" كامنة محددة (مثل الخداع والتلاعب) أثناء الضبط الدقيق، والتي يمكن تتبعها سببيًا إلى السرديات في مرحلة ما قبل التدريب حول الشخصيات الشريرة، ولكن يتم استحثاثها بشكل أكثر فعالية من خلال أزواج التعليمات والاستجابة الاصطناعية بدلاً من النصوص البشرية التي تحدث بشكل طبيعي.

Clemens Vetter, David Kaczér, Lucie Flek, Florian Mai2026-08-12
🤖 machine learning

ReRound: Reconstructive Rounding to Resolve Midpoint Ambiguity in Calibration-Free LLM Quantization

تُعد ReRound طريقةً للكمّ بعد التدريب خالية من المعايرة، تستفيد من نموذج انتشار شرطي لحل غموض تقريب المنتصف في أوزان النماذج اللغوية الكبيرة ذات البتات المنخفضة، وهي تتفوق باستمرار على التقنيات القياسية في الكمّ بـ 3 بت و4 بت مع الحفاظ على الكفاءة دون اتصال.

He-Yen Hsieh, H. T. Kung2026-08-12
💬 NLP

Multiclass Sentiment Analysis for Identifying Political Viewpoints

تتقصى هذه الورقة تحليل المشاعر متعدد الفئات لوجهات النظر السياسية على وسائل التواصل الاجتماعي من خلال تصميم وتقييم نموذجي XGBoost وBERT، اللذين حققا درجات F1 متقاربة تبلغ حوالي 0.28، مما يسلط الضوء على التحديات المتأصلة في تصنيف الخطاب السياسي المعقد ويضع حجر أساس للأبحاث المستقبلية.

Girma Yohannis Bade, Olga Kolesnikova, Jose Luis Oropeza, Grigori Sidorov2026-08-12
💬 NLP

Actions Speak Louder than Words: Measuring Cross-Lingual Policy Retention in Tool-Using Agents

تقدم هذه الورقة إطاراً صارماً لقياس الاحتفاظ بالسياسات عبر اللغات لدى الوكلاء المستخدمين للأدوات من خلال تصحيح خمسة عوامل مربكة حرجة، كاشفةً أن النماذج الرائدة تحتفظ هيكلياً بنسبة 71-73% من سياسات الإجراء الخاصة بها عبر اللغات عن طريق توجيه المهام غير الإنجليزية عبر الإنجليزية، بينما تظهر النماذج الأصغر انهيارات، كما يمكن تصنيع حالات الفشل الملحوظة اصطناعياً بواسطة التعبيرات النمطية لاستخراج الأثر بدلاً من كونها قصوراً في النموذج.

Sourabrata Mukherjee, Kalika Bali, Sunayana Sitaram2026-08-12
💬 NLP

The Illusion of Cross-Lingual Safety in Low-Resource Languages

تكشف هذه الورقة أن محاذاة السلامة في النماذج اللغوية الكبيرة، التي طُورت أساساً باللغة الإنجليزية، تفشل في التعميم على اللغات الأفريقية ذات الموارد المنخفضة مثل التوي والهاوسا والأمهرية والسواحيلية، حيث تحتفظ المطالبات الضارة في هذه اللغات بأقل من 10% من إشارة الرفض الإنجليزية رغم التوافق الدلالي، مما يشير إلى أن آليات السلامة متعددة اللغات الحالية سطحية وغير فعالة.

Abigail Oppong, P Sam Sahil, Tadesse Destaw Belay, Maryam Ibrahim Mukhtar, Esmael Ahmed Abdu, Tassallah Abdullahi, Jessi (…)2026-08-12
💬 NLP

MultiModal Code-Switching: Interleaving Visual Objects into Language for Explicit Object-Level Alignment

تقدم الورقة البحثية نموذج التبديل اللغوي متعدد الوسائط (MMCS)، وهو نموذج تدريب مسبق مبتكر يدمج الكائنات المرئية ضمن النصوص لتوفير إشراف صريح على مستوى الكائن، مما يحسن بشكل كبير من كفاءة البيانات وقدرات الربط البصري مقارنة بطرق محاذاة الصور والنصوص التقليدية.

Changhao Xiang, Shangyu Xing, Zhen Wu, Jianbing Zhang, Xinyu Dai2026-08-12
💬 NLP

From Interpretability to Control: Insights from Six Years of the TrustNLP Workshop

تجمع هذه الورقة الرؤى المستخلصة من 144 ورقة بحثية عبر ست سنوات من ورشة عمل TrustNLP لتوثيق تطور المجال من التفسير اللاحق إلى التحكم الآلي، مع تسليط الضوء على الصعود السريع في أبحاث الصدق، والمسار الذي يتخذ شكل حرف U بالنسبة للقابلية للتفسير، والتوافق الموضوعي مع اتجاهات معالجة اللغات الطبيعية الأوسع نطاقاً.

Rahul Gupta, Abhinav Mohanty, Anaelia Ovalle, Anil Ramakrishna, Anubrata Das, Apurv Verma, Jwala Dhamala, Ninareh Mehrab (…)2026-08-12
💬 NLP

Artificial Leviathan: Exploring Social Evolution of LLM Agents Through the Lens of Hobbesian Social Contract Theory

تُثبت هذه الورقة أن وكلاء النماذج اللغوية الكبيرة، عند وضعهم في بيئة بقاء محاكية، يتطورون طبيعياً من "حالة طبيعة" فوضوية إلى مجتمع منظم ذي سيادة مطلقة، مما يثبت تجريبياً نظرية العقد الاجتماعي لتوماس هوبز ويسلط الضضوء على إمكانات المحاكاة متعددة الوكلاء المدفوعة بالنماذج اللغوية الكبيرة لدراسة الديناميكيات الاجتماعية المعقدة.

Gordon Dai, Weijia Zhang, Jinhan Li, Siqi Yang, Chidera Onochie lbe, Srihas Rao, Arthur Caetano, Misha Sra2026-08-11
⚡ electrical engineering

LF2{}^{2}AR: Accounting for Layerwise Dynamics to Improve Multimodal Adaptation of Language Models

تقدم الورقة البحثية LF2{}^{2}AR، وهي بنية مبتكرة تعمل على تحسين التكيف متعدد الوسائط للنماذج اللغوية من خلال الاستفادة من ديناميكيات التجريد والتحسين عبر الطبقات عبر دمج الوسائط المتأخر، والانشطار المتأخر مع البواقي الانتباهية، وآليات الوصول الانتقائي، مما يؤدي إلى تعزيز المحاذاة عبر الوسائط، وأداء الاستدلال، وفك التشفير بكفاءة عند الخروج المبكر.

Santiago Cuervo, Adel Moumen, Yanis Labrak, Sameer Khurana, Antoine Laurent, Mickael Rouvier, Phil Woodland, Ricard Marx (…)2026-08-11