💬 NLP

Beyond speculation: Measuring the growing presence of LLM-generated texts in multilingual disinformation

تقدم هذه الدراسة أول دليل تجريبي على الوجود المتزايد للمحتوى المُنشأ بواسطة النماذج اللغوية الكبيرة في مجموعات بيانات التضليل متعددة اللغات في العالم الحقيقي في أعقاب إصدار ChatGPT، حيث توثق أنماطًا محددة عبر اللغات والمنصات والفترات الزمنية لسد الفجوة في الجدل الأكاديمي حول الحجم الفعلي لهذا التهديد.

Dominik Macko, Aashish Anantha Ramakrishnan, Jason Samuel Lucas, Robert Moro, Ivan Srba, Adaku Uchendu, Dongwon Lee2026-02-05
💬 NLP

PaTH Attention: Position Encoding via Accumulating Householder Transformations

تقدم هذه الورقة البحثية PaTH، وهو نظام ترميز موضعي مرن ومعتمد على البيانات يقوم على تحويلات "هاوسدورفر" المتراكمة، والذي يتفوق على ترميز الموضع الدوراني (RoPE) القياسي في مهام نمذجة اللغة، مع توفير تدريب متوازٍ فعال والقدرة على تحويل نماذج RoPE مسبقة التدريب.

Songlin Yang, Yikang Shen, Kaiyue Wen, Shawn Tan, Mayank Mishra, Liliang Ren, Rameswar Panda, Yoon Kim2026-02-05
💬 NLP

Evaluating and Steering Modality Preferences in Multimodal Large Language Model

تقدم هذه الورقة معيار MC² لتقييم تفضيلات الأنماط في النماذج اللغوية الكبيرة متعددة الوسائط (MLLMs) بشكل منهجي، كاشفةً أن هذه التفضيلات ترتبط بالأداء في المهام ويمكن توجيهها بفعالية نحو الاتجاهات المرغوبة باستخدام طريقة قائمة على هندسة التمثيل دون الحاجة إلى ضبط دقيق إضافي.

Yu Zhang, Jinlong Ma, Yongshuai Hou, Xuefeng Bai, Kehai Chen, Yang Xiang, Jun Yu, Min Zhang2026-02-05
💬 NLP

DPO Unchained: Your Training Algorithm is Secretly Disentangled in Human Choice Theory

تعمم هذه الورقة البحثية العلاقة بين تحسين التفضيل المباشر (DPO) ونظرية الاختيار البشري من خلال إعادة صياغة النماذج المعيارية لإنشاء إطار عمل واسع يدعم الخسائر غير المحدبة، ويدمج خيارات تحليلية متنوعة، ويحمي مختلف امتدادات تحسين التفضيل المباشر (DPO).

Wenxuan Zhou, Shujian Zhang, Brice Magdalou, John Lambert, Ehsan Amid, Richard Nock, Andrew Hard2026-02-05
💬 NLP

PromotionGo at SemEval-2025 Task 11: A Feature-Centric Framework for Cross-Lingual Multi-Emotion Detection in Short Texts

تقدم هذه الورقة إطار عمل متمحوراً حول الميزات وقابلاً للتوسع للكشف عن المشاعر المتعددة عبر اللغات في النصوص القصيرة، والذي يكيف ديناميكياً تمثيلات المستندات وخوارزميات التعلم عبر 28 لغة، مما يثبت أن تقنية TF-IDF تتفوق في الإعدادات ذات الموارد المنخفضة بينما توفر التضمينات السياقية والنماذج العصبية المعززة بتحليل المكونات الرئيسية (PCA) أداءً وكفاءة مثاليين للسياقات اللغوية المتنوعة.

Ziyi Huang, Xia Cui2026-02-05
💬 NLP

Addressing Data Imbalance in Transformer-Based Multi-Label Emotion Detection with Weighted Loss

تستقصي هذه الورقة استخدام دوال الخسارة الموزونة في النماذج القائمة على تقنية "ترانسفورمر" للكشف عن العواطف متعددة الملصقات في مجموعة بيانات "BRIGHTER"، حيث وجدت أنه بينما يعزز هذا النهج الأداء بفعالية في الفئات عالية التكرار، فإنه يقدم تحسناً محدوداً لفئات العواطف الأقلية.

Xia Cui2026-02-05
💬 NLP

The Invisible Leash: Why RLVR May or May Not Escape Its Origin

تثبت هذه الورقة تجريبياً أنه في حين أن التعلم المعزز بالمكافآت القابلة للتحقق (RLVR) يحسن دقة النماذج اللغوية الكبيرة بشكل كبير، إلا أنه يفشل في النهاية في توسيع حدود الاستدلال لأن تحسينه المقيد بالدعم يضيق مساحة الحلول الخاصة بالنموذج، مما يؤدي غالباً إلى تجاهله لإجابات صحيحة كانت متاحة سابقاً للنموذج الأساسي.

Fang Wu, Weihao Xuan, Ximing Lu, Mingjie Liu, Yi Dong, Zaid Harchaoui, Yejin Choi2026-02-05
📊 statistics

Improving Detection of Watermarked Language Models

تقترح هذه الورقة وتقيم مخططات كشف هجينة تجمع بين الكواشف القائمة على العلامة المائية وغير القائمة على العلامة المائية لتحسين تحديد توليدات النماذج اللغوية الموسومة بالعلامات المائية، لا سيما في السيناريوهات التي تعيق فيها الإنتروبيا المحدودة الكشف المستقل عن العلامة المائية.

Dara Bahri, John Wieting2026-02-05
💬 NLP

When Avatars Have Personality: Effects on Engagement and Communication in Immersive Medical Training

تقدم هذه الورقة إطار عمل نموذجياً يدمج النماذج اللغوية الكبيرة في الواقع الافتراضي لإنشاء مرضى افتراضيين متماسكين طبياً وذوي سمات شخصية، مما يثبت من خلال دراسة مع أطباء مرخصين أن هذه الشخصيات الرمزية (avatars) ذات الواقعية النفسية تعزز بشكل كبير التدريب الطبي الغامر لتطوير مهارات التواصل.

Julia S. Dollis, Iago A. Brito, Fernanda B. Färber, Pedro S. F. B. Ribeiro, Gustavo H. W. Barbosa, Andressa A. Bastos, R (…)2026-02-05
💬 NLP

MapCoder-Lite: Distilling Multi-Agent Coding into a Single Small LLM

يُعد MapCoder-Lite إطار عمل يعمل على تقطير قدرات البرمجة المعقدة متعددة الوكلاء في نموذج لغوي واحد بحجم 7 مليارات معلمة من خلال منهجية مبتكرة ثلاثية الركائز تعتمد على تقطير المسار، والتصحيح الموجه من قِبل المشرف، والضبط الدقيق لتقنية LoRA لكل وكيل، محققاً بذلك أداءً تنافسياً في اختبارات البرمجة المرجعية مع تقليل التكاليف الحسابية بشكل كبير مقارنة بالنماذج الأكبر حجماً.

Woongkyu Lee, Junhee Cho, Jungwook Choi2026-02-05