💬 NLP

AVISE: Framework for Evaluating the Security of AI Systems

تقدم هذه الورقة البحثية AVISE، وهو إطار عمل مفتوح المصدر ومعياري لتحديد الثغرات الأمنية وتقييم أمن أنظمة الذكاء الاصطناعي بشكل منهجي، والذي تم استعراضه من خلال اختبار تقييم أمني مؤتمت نجح في اكتشاف ثغرات كسر الحماية (jailbreak) في تسعة نماذج لغوية متنوعة باستخدام هجوم "الملكة الحمراء" (Red Queen attack) المعزز.

Mikko Lempinen, Joni Kemppainen, Niklas Raesalmi2026-04-23
💬 NLP

Will the Prince Get True Love's Kiss? On the Model Sensitivity to Gender Perturbation over Fairytale Texts

تتقصى هذه الورقة حساسية النماذج اللغوية تجاه الصور النمطية الجندرية في فهم القصص الخيالية من خلال إثبات أنه بينما تظهر النماذج في البداية انخفاضاً في الأداء عند مواجهة الاضطرابات الجندرية، فإن الضبط الدقيق على البيانات الواقعية المضادة يعزز بشكل كبير من متانتها تجاه السرديات المناقضة للصور النمطية.

Christina Chance, Da Yin, Dakuo Wang, Kai-Wei Chang2026-04-22
💬 NLP

"You tell me": A Dataset of GPT-4-Based Behaviour Change Support Conversations

تقدم هذه الورقة مجموعة بيانات من التفاعلات النصية بين المستخدمين وعميلين محاورين يعتمدان على نموذج GPT-4 ويركزان على تغيير السلوك، جُمعت عبر دراسة مستخدم مسجلة مسبقاً لمعالجة نقص الأبحاث حول سلوك المستخدم وتأثيره على التدخلات بأسلوب الاستشارة التي تولدها النماذج اللغوية الكبيرة.

Selina Meyer, David Elsweiler2026-04-22
💬 NLP

Effects of Collaboration on the Performance of Interactive Theme Discovery Systems

تقترح هذه الورقة إطار تقييم موحداً لتحليل كيفية تأثير بيئات التعاون المتزامنة مقابل غير المتزامنة على الاتساق والتماسك وصحة المخرجات عبر ثلاثة أنظمة مختلفة لاكتشاف المواضيع التفاعلية بمساعدة معالجة اللغات الطبيعية.

Alvin Po-Chun Chen, Rohan Das, Dananjay Srinivas, Alexandra Barry, Maksim Seniw, Maria Leonor Pacheco2026-04-22
💬 NLP

Persuasion with Large Language Models: A Survey of Empirical Evidence, Study Methodologies, and Ethical Implications

تستعرض هذه الدراسة الأدلة التجريبية التي تثبت قدرة النماذج اللغوية الكبيرة على تحقيق مستوى من الإقناع يضاهي البشر أو يتفوق عليهم في مجالات متنوعة، مع تحليل العوامل المنهجية التي تعزز هذه الفعالية ونقدها، وتسليط الضوء على المخاطر الأخلاقية والمجتمعية الملحة التي تشكلها على الاستقلالية والعدالة وسلامة المعلومات.

Sander Noels, Alexander Rogiers, Maarten Buyl, Tijl De Bie2026-04-22
💬 NLP

CASS: Nvidia to AMD Transpilation with Data, Models, and Benchmark

تقدم الورقة البحثية CASS، وهي أول مجموعة بيانات ونماذج لترجمة أكواد وحدات معالجة الرسومات عبر البنى المختلفة (من CUDA إلى HIP ومن SASS إلى RDNA3)، والتي تحقق دقة ترجمة وحفاظاً على الأداء من فئة الحالة الراهنة مع التفوق على النماذج التجارية المرجعية مثل GPT-5.1 وHipify.

Ahmed Heakl, Gustavo Bertolo Stahl, Sarim Hashmi, Seung Hun Eddie Han, Mukul Ranjan, Arina Kharlamova, Salman Khan, Abdu (…)2026-04-22
💬 NLP

OmniGen2: Towards Instruction-Aligned Multimodal Generation

يُعد OmniGen2 نموذجاً مفتوح المصدر، متوافقاً مع التعليمات ومتعدد الوسائط، يستخدم بنية ذات مسارين بمعلمات منفصلة لتحقيق أداء رائد في مهام تحويل النص إلى صورة، وتحرير الصور، والتوليد السياقي القائم على الموضوع، مع الحفاظ على القدرات النصية الحالية.

Chenyuan Wu, Pengfei Zheng, Ruiran Yan, Shitao Xiao, Xin Luo, Yueze Wang, Wanli Li, Xiyan Jiang, Yexin Liu, Junjie Zhou (…)2026-04-22
💬 NLP

Improving the Distributional Alignment of LLMs using Supervision

تُثبت هذه الورقة أن إضافة إشراف بسيط يحسن باستمرار من توافق التوزيعات التي تولدها النماذج اللغوية الكبيرة مع المجموعات السكانية المتنوعة عبر مجموعات بيانات الصحة العامة والآراء والقيم، مع توفير معيار شامل لتوجيه الأبحاث المستقبلية.

Gauri Kambhatla, Sanjana Gautam, Angela Zhang, Alex Liu, Ravi Srinivasan, Junyi Jessy Li, Matthew Lease2026-04-22
🤖 machine learning

Watch the Weights: Unsupervised monitoring and control of fine-tuned LLMs

تقدم هذه الورقة طريقة غير خاضعة للإشراف ومبتكرة لمراقبة والتحكم في النماذج اللغوية الكبيرة التي خضعت لضبط دقيق من خلال تحليل فروق الأوزان بدلاً من التنشيطات، مما يتيح اكتشاف الأبواب الخلفية، والتحقق من عملية محو التعلم، وتدقيق سلوكيات النماذج دون الحاجة إلى بيانات تدريب متشابهة توزيعياً.

Ziqian Zhong, Aditi Raghunathan2026-04-22
💬 NLP

SitEmb-v1.5: Improved Context-Aware Dense Retrieval for Semantic Association and Long Story Comprehension

تقدم الورقة البحثية SitEmb، وهو نموذج تدريب جديد وسلسلة من نماذج التضمين (v1.5) التي تعزز التوليد المعزز بالاسترجاع للمستندات الطويلة عن طريق ترميز الأجزاء القصيرة ضمن سياقها الأوسع، محققةً أداءً هو الأفضل في فئته في استرجاع حبكات الكتب والمهام اللاحقة بعدد أقل بكثير من المعلمات مقارنة بالنماذج الضخمة الحالية.

Junjie Wu, Jiangnan Li, Yuqing Li, Lemao Liu, Liyan Xu, Jiwei Li, Dit-Yan Yeung, Jie Zhou, Mo Yu2026-04-22