💬 NLP

TextReg: Mitigating Prompt Distributional Overfitting via Regularized Text-Space Optimization

تقدم الورقة البحثية TextReg، وهو إطار تنظيم يعمل على الحد من الإفراط في التخصيص لتوزيع المطالبات في النماذج اللغوية الكبيرة من خلال التحكم في عدم كفاءة التمثيل عبر التدرجات النصية، مما يحسن بشكل كبير من تعميم خارج التوزيع مقارنة بطرق التحسين الحالية.

Lucheng Fu, Ye Yu, Yiyang Wang, Yiqiao Jin, Haibo Jin, B. Aditya Prakash, Haohan Wang2026-05-21
💬 NLP

Text Analytics Evaluation Framework: A Case Study on LLMs and Social Media

تقدم هذه الورقة إطار تقييم قائم على الأسئلة لتقدير قدرات النماذج اللغوية الكبيرة في تحليل النصوص الطويلة وغير المنظمة من وسائل التواصل الاجتماعي، كاشفةً أن أداءها يتدهور بشكل ملحوظ مع زيادة حجم المدخلات، وتعقيد المهام، ومتطلبات الاستدلال العددي.

Yuefeng Shi, Nedjma Ousidhoum, Jose Camacho-Collados2026-05-21
💬 NLP

LASH: Adaptive Semantic Hybridization for Black-Box Jailbreaking of Large Language Models

تقدم الورقة البحثية LASH، وهو إطار عمل للصندوق الأسود يقوم بتكوين مخرجات استراتيجيات كسر الحماية غير المتجانسة متعددة بشكل تكيفي باستخدام مُحسِّن جيني لتحقيق معدلات نجاح هجوم في حالة الذروة على النماذج اللغوية الكبيرة المتوافقة بأقل ميزانية استعلامات.

Abdullah Al Nomaan Nafi, Fnu Suya, Swarup Bhunia, Prabuddha Chakraborty2026-05-21
💬 NLP

"I didn't Make the Micro Decisions": Measuring, Inducing, and Exposing Goal-Level AI Contributions in Collaboration

تقدم هذه الورقة CoTrace، وهو إطار عمل للعزو على مستوى الأهداف يكشف كيف تؤثر النماذج اللغوية الكبيرة بشكل كبير على صقل المتطلبات الملموسة وتشكيل الأهداف الإجمالية في التعاون بين الإنسان والذكاء الاصطناعي، مما يثبت أن كشف هذه المساهمات التفصيلية يساعد المستخدمين على تصحيح سوء المعايرة المنهجي لديهم فيما يتعلق بدور الذكاء الاصطناٍ في عملهم.

Eunsu Kim, Jessica R. Mindel, Kyungjin Kim, Sherry Tongshuang Wu2026-05-21
💬 NLP

Quantifying the cross-linguistic effects of syncretism on agreement attraction

تستخدم هذه الدراسة مفاهيم "المفاجأة" (surprisal) و"اعتلاج الانتباه" (attention entropy) من النماذج اللغوية الكبيرة لتوضيح أن التآزر الصرفي (morphological syncretism) يعدل أخطاء جذب المطابقة في اللغتين الإنجليزية والألمانية ولكن ليس في التركية، مما يقدم منظوراً حوسبياً للتباينات عبر اللغات في هذه الظاهرة.

Utku Turk, Eva Neu2026-05-21
💬 NLP

You Only Need Minimal RLVR Training: Extrapolating LLMs via Rank-1 Trajectories

تقدم هذه الورقة البحثية RELEX، وهي طريقة فعالة حوسبياً تستفيد من الاكتشاف القائل بأن مسارات أوزان RLVR قابلة للتنبؤ للغاية ومنخفضة الرتبة لاستقراء نقاط تفتيش النماذج المستقبلية عبر الانحدار الخطي، محققةً أداءً يضاهي أو يتجاوز التدريب الكامل باستخدام جزء ضئيل فقط من الخطوات من خلال تصفية ضوضاء التحسين العشوائية.

Zhepei Wei, Xinyu Zhu, Wei-Lin Chen, Chengsong Huang, Jiaxin Huang, Yu Meng2026-05-21
💬 NLP

Retrieval-Augmented Generation for Natural Language Processing: A Survey

تقدم هذه الورقة مسحاً منهجياً لتقنية التوليد المعزز بالاسترجاع (RAG) في معالجة اللغات الطبيعية، حيث تقدم تصنيفاً جديداً لطرق دمج الاسترجاع، وتحلل التطبيقات وتحديات التقييم، وتحدد التوجهات المستقبلية للنشر الصناعي.

Shangyu Wu, Ying Xiong, Yufei Cui, Haolun Wu, Can Chen, Ye Yuan, Lianming Huang, Xue Liu, Tei-Wei Kuo, Nan Guan, Chun Ja (…)2026-05-20
💬 NLP

HALvest-Contrastive: Retrieval-Like Authorship Attribution with Patch-Level Late Interaction

تقدم هذه الورقة HALvest، وهو متن لغوي ضخم متعدد اللغات من الأوراق البحثية، وإطار عمل جديد لاسترجاع التفاعل المتأخر على مستوى الرقعة (PLI) يحسن دقة إسناد المؤلفية بشكل كبير من خلال مقارنة تسلسلات من رقع التوكن بدلاً من ضغط المستندات في نواقل مفردة، مما يخفف بفعالية من الارتباكات الموضوعية.

Francis Kulumba, Wissam Antoun, Guillaume Vimont, Laurent Romary, Florian Cafiero2026-05-20
💬 NLP

Entry-level guide to the use of large language models for medical research

تقدم هذه الورقة دليلاً عملياً للمبتدئين من المتخصصين في الرعاية الصحية لدمج النماذج اللغوية الكبيرة المتطورة بفعالية وأمان في الأبحاث الطبية والممارسة السريرية من خلال سير عمل مهيكل يشمل صياغة المهام، واختيار النماذج، وهندسة الأوامر، والضبط الدقيق، والنشر المسؤول.

Qiao Jin, Nicholas Wan, Robert Leaman, Shubo Tian, Zhizheng Wang, Yifan Yang, Zifeng Wang, Guangzhi Xiong, Po-Ting Lai (…)2026-05-20
💬 NLP

Scaling Evaluation-time Compute with Reasoning Models as Evaluators

تُثبت هذه الورقة أن استخدام نماذج الاستدلال كأدوات تقييم مع زيادة الحوسبة في وقت الاختبار — وتحديداً من خلال التقييم المرحلي خطوة بخطوة — يحسن دقة التقييم بشكل كبير ويمكن أن يعزز قدرات النماذج اللغوية في حل المشكلات من خلال إعادة الترتيب، مما يحاكي فوائد توسيع نطاق الحوسبة أثناء عملية التوليد.

Seungone Kim, Ian Wu, Jinu Lee, Xiang Yue, Seongyun Lee, Mingyeong Moon, Carolin Lawrence, Kiril Gashteovski, Julia Hock (…)2026-05-20