💬 NLP

Learning to Communicate: Toward End-to-End Optimization of Multi-Agent Language Systems

تقدم الورقة البحثية إطار عمل DiffMAS، الذي يعمل على تحسين الأنظمة متعددة الوكلاء من خلال التعامل مع التواصل الكامن كمكون قابل للتعلم، مما يؤدي إلى تحسين دقة الاستنتاج واستقراره بشكل كبير عبر مختلف المعايير المرجعية مقارنة بالأساليب القائمة على النصوص والأساليب الكامنة السابقة.

Ye Yu, Heming Liu, Haibo Jin, Xiaopeng Yuan, Peng Kuang, Haohan Wang2026-04-24
💬 NLP

Machine Behavior in Relational Moral Dilemmas: Moral Rightness, Predicted Human Behavior, and Model Decisions

تكشف هذه الدراسة أنه في حين تتنبأ النماذج اللغوية الكبيرة بدقة بأن البشر يمنحون الأولوية للولاء على العدالة في العلاقات الوثيقة، إلا أن هذه النماذج نفسها تلتزم بصرامة بالقواعد الأخلاقية القائمة على العدالة، مما يكشف عن عدم توافق حرج بين فهمها الاجتماعي الداخلي وسلوك اتخاذ القرار لديها.

Jiseon Kim, Jea Kwon, Luiz Felipe Vecchietti, Wenchao Dong, Jaehong Kim, Meeyoung Cha2026-04-24
💬 NLP

Revisiting Non-Verbatim Memorization in Large Language Models: The Role of Entity Surface Forms

تقدم هذه الورقة البحثية RedirectQA، وهي مجموعة بيانات تستخدم عمليات إعادة التوجيه في ويكيبيديا لتقييم كيفية حفظ النماذج اللغوية الكبيرة للحقائق عبر مختلف الأشكال السطحية المتنوعة للكيانات، مما يكشف أن استرجاع الحقائق ليس مرتبطاً بالكامل بالشكل السطحي ولا ثابتاً تماماً، بل يتأثر بشكل كبير بنوع وتكرار الشكل السطحي المستخدم.

Yuto Nishida, Naoki Shikoda, Yosuke Kishinami, Ryo Fujii, Makoto Morishita, Hidetaka Kamigaito, Taro Watanabe2026-04-24
💬 NLP

Mapping the Political Discourse in the Brazilian Chamber of Deputies: A Multi-Faceted Computational Approach

تقدم هذه الورقة إطاراً حوسبياً قابلاً للتوسع يجمع بين التحليل الأسلوبي، ونمذجة المواضيع، والتجميع الدلالي لتحليل أكثر من 450,000 خطاب في مجلس النواب البرازيلي (2003-2025)، كاشفةً عن تحولات طويلة الأمد نحو الخطاب المباشر، وإعادة توجيهات الأجندة المدفوعة بالأزمات، والاصطفافات الخطابية حيث غالباً ما تتجاوز الهويات الإقليمية والجندرية الانتماء الحزبي الرسمي.

Flávio Soriano, Victoria F. Mello, Pedro B. Rigueira, Gisele L. Pappa, Wagner Meira Jr., Ana Paula Couto da Silva, Jussa (…)2026-04-24
💬 NLP

When Prompts Override Vision: Prompt-Induced Hallucinations in LVLMs

تقدم هذه الورقة البحثية HalluScope، وهو معيار يكشف أن الهلوسة في النماذج اللغوية البصرية الكبيرة مدفوعة بشكل أساسي بالانحيازات المسبقة للتعليمات النصية، وتقترح HalluVL-DPO، وهو إطار عمل لتحسين التفضيل يعمل بفعالية على تخفيف هذه الهلوسات الناجمة عن الأوامر مع الحفاظ على القدرات البصرية.

Pegah Khayatan, Jayneel Parekh, Arnaud Dapogny, Mustafa Shukor, Alasdair Newson, Matthieu Cord2026-04-24
💬 NLP

MathDuels: Evaluating LLMs as Problem Posers and Solvers

تقدم الورقة البحثية MathDuels، وهو معيار لعب ذاتي ديناميكي حيث تعمل النماذج اللغوية الرائدة في آن واحد كواضعي مسائل تنافسيين وحلالين لها، مستخدمةً نموذج راش (Rasch model) للكشف عن القدرات المنفصلة ومنع تشبع التقييم من خلال منحنى صعوبة يتطور بشكل مشترك.

Zhiqiu Xu, Shibo Jin, Shreya Arya, Mayur Naik2026-04-24
💬 NLP

Evaluation of Automatic Speech Recognition Using Generative Large Language Models

تُثبت هذه الورقة أن النماذج اللغوية الكبيرة القائمة على فك التشفير تتفوق بشكل كبير على معدل خطأ الكلمات التقليدي والمقاييس الدلالية الحالية في تقييم التعرف الآلي على الكلام، وذلك من خلال تحقيق توافق بنسبة 92-94% مع المقيّمين البشريين في اختيار الفرضيات، وتقديم مسار واعد نحو تقييم مفسر ومدرك للمعنى.

Thibault Bañeras-Roux, Shashi Kumar, Driss Khalil, Sergio Burdisso, Petr Motlicek, Shiran Liu, Mickael Rouvier, Jane Wot (…)2026-04-24
💬 NLP

LoRA-FA: Efficient and Effective Low Rank Representation Fine-tuning

تقدم هذه الورقة البحثية LoRA-FA، وهي طريقة لضبط المعلمات بكفاءة عالية تعتمد على تجميد أحد عوامل LoRA وتطبيق تصحيحات تدرج ذات صيغة مغلقة لتحقيق أداء يضاهي الضبط الدقيق الكامل مع تقليل استهلاك الذاكرة وعبء العمل الحسابي بشكل كبير.

Longteng Zhang, Lin Zhang, Shaohuai Shi, Xiaowen Chu, Bo Li2026-04-23
💬 NLP

LLAMADRS: Evaluating Open-Source LLMs on Real Clinical Interviews--To Reason or Not to Reason?

تقدم الورقة البحثية LlaMADRS، وهو معيار لتقييم النماذج اللغوية الكبيرة مفتوحة المصدر على مقابلات نفسية حقيقية، موضحاً أن استراتيجيات "العنصر ثم المجموع" المهيكلة والمطالبات المصممة جيداً غالباً ما تتفوق على نماذج التقييم المباشر أو النماذج المعززة بالاستدلال في مهام التقييم السريري.

Gaoussou Youssouf Kebe, Jeffrey M. Girard, Einat Liebenthal, Justin Baker, Fernando De la Torre, Louis-Philippe Morency2026-04-23
💬 NLP

Caught in the Web of Words: Do LLMs Fall for Spin in Medical Literature?

تكشف هذه الدراسة أنه في حين أن ٢٢ نموذجاً من نماذج اللغات الكبيرة التي تم تقييمها هي، بشكل عام، أكثر عرضة للانحياز في الأدبيات الطبية مقارنة بالبشر وقد تنشره في ملخصاتها، إلا أنه يمكن توجيهها بفعالية للتعرف على هذا الانحياز والحد منه.

Hye Sun Yun, Karen Y. C. Zhang, Ramez Kouzy, Iain J. Marshall, Junyi Jessy Li, Byron C. Wallace2026-04-23