💬 NLP

Bridging the Culture Gap: A Framework for LLM-Driven Socio-Cultural Localization of Math Word Problems in Low-Resource Languages

تقدم هذه الورقة إطار عمل مدفوعاً بنماذج اللغات الكبيرة يقوم تلقائياً بتوطين المسائل اللفظية الرياضية في اللغات ذات الموارد المنخفضة من خلال استبدال الكيانات المتمحورة حول اللغة الإنجليزية بأسماء ومنظمات وعملات محلية ذات صلة ثقافياً، مما يعالج ندرة البيانات ويعزز متانة الاستدلال الرياضي متعدد اللغات.

Israel Abebe Azime, Tadesse Destaw Belay, Dietrich Klakow, Philipp Slusallek, Anshuman Chhabra2026-04-21
💬 NLP

What makes an entity salient in discourse?

تتقصى هذه الورقة البحثية كيفية تفاعل مؤشرات البروز على مستوى العبارة مع عوامل مستوى الكيان والتباينات النوعية لتحديد البروز على مستوى الخطاب، وتجد أنه في حين ترتبط السمات النحوية بالبروز، فإن العوامل البنيوية للخطاب والدلالية تعد محددات أكثر قوة عبر 24 نوعاً أدبياً من اللغة الإنجليزية.

Amir Zeldes, Jessica Lin2026-04-21
💬 NLP

BASIL: Bayesian Assessment of Sycophancy in LLMs

تقدم هذه الورقة BASIL، وهو إطار عمل احتمالي بايزي يعمل على فصل تحولات المعتقدات الناتجة عن التملق عن التحديثات العقلانية في النماذج اللغوية الكبيرة، مما يوفر مقاييس لتحديد وقياس وتخفيف حدة التملق حتى في المهام التي تفتقر إلى تسميات الحقيقة الأرضية.

Katherine Atwell, Pedram Heydari, Anthony Sicilia, Malihe Alikhani2026-04-21
💬 NLP

Evalet: Evaluating Large Language Models through Functional Fragmentation

تقدم الورقة البحثية Evalet، وهو نظام تفاعلي يستخدم التجزئة الوظيفية لتفكيك المخرجات المولدة بواسطة النماذج اللغوية الكبيرة إلى مكونات بلاغية رئيسية، مما يمكّن الممارسين من تجاوز الدرجات الشمولية الغامضة وتحديد عدم توافق التقييم المحدد من خلال تحليل نوعي دقيق.

Tae Soo Kim, Heechan Lee, Yoonjoo Lee, Joseph Seering, Juho Kim2026-04-21
💬 NLP

The Role of Vocabularies in Learning Sparse Representations for Ranking

تتقصى هذه الورقة البحثية تأثير حجم المفردات والتهيئة على نماذج الاسترجاع المتناثرة المتعلمة، حيث تُثبت أن نماذج ESPLADE ذات المفردات المُدربة مسبقاً بحجم 100 ألف تتفوق على النماذج القياسية ذات الـ 32 ألفاً من حيث الفعالية مع الحفاظ على تكاليف حوسبة مماثلة بعد عملية التقليم، مما يسلط الضضواء على تكوين المفردات كعامل حاسم لتحسين كفاءة وفعالية الاسترجاع.

Hiun Kim, Tae Kwan Lee, Taeryun Won2026-04-21
💬 NLP

On the Shelf Life of Fine-Tuned LLM-Judges: Future-Proofing, Backward-Compatibility, and Question Generalization

تتقصى هذه الورقة البحثية "العمر الافتراضي" لنماذج الحكم من النماذج اللغوية الكبيرة (LLMs) التي خضعت للضبط الدقيق، وذلك عبر صياغة وتقييم قدرتها على مواكبة المستقبل، والتوافق مع الإصدارات السابقة، وتعميم الأسئلة، مما يكشف أنه في حين أن التوافق مع الإصدارات السابقة يتسم بالمتانة، فإن مواكبة المستقبل تظل تحدياً، كما تعاني النماذج الحالية من صعوبة في التعميم الكامل على الأسئلة غير المرئية.

Janvijay Singh, Austin Xu, Yilun Zhou, Yefan Zhou, Dilek Hakkani-Tur, Shafiq Joty2026-04-21
💬 NLP

Interpreting Language Models Through Concept Descriptions: A Survey

تقدم هذه الورقة أول مسح للمجال الناشئ المتمثل في استخدام أوصاف المفاهيم باللغة الطبيعية لتفسير مكونات النماذج اللغوية الكبيرة، حيث تراجع بشكل منهجي طرق التوليد، ومقاييس التقييم، ومجموعات البيانات، مع تسليط الضوء على الحاجة الملحة لإجراء تقييم سببي أكثر صرامة لتعزيز شفافية النموذج.

Nils Feldhus, Laura Kopf2026-04-21
💬 NLP

CreditDecoding: Accelerating Parallel Decoding in Diffusion Large Language Models with Trace Credit

يُعد CreditDecoding طريقة فك تشفير متوازية لا تتطلب تدريباً لنماذج اللغات الكبيرة القائمة على الانتشار، حيث تعمل على تسريع الاستنتاج من خلال إدخال "رصيد الأثر" (Trace Credit) لقياس واستغلال التكرار الزمني في آثار إزالة الضجيج، مما يعزز ثقة الرموز المتوقعة بشكل صحيح ولكنها تفتقر إلى الثقة الكافية لتحقيق تسريع كبير دون التضحية بالدقة.

Kangyu Wang, Zhiyun Jiang, Haibo Feng, Weijia Zhao, Lin Liu, Jianguo Li, Zhenzhong Lan, Weiyao Lin2026-04-21
💬 NLP

How Language Models Conflate Logical Validity with Plausibility: A Representational Analysis of Content Effects

تكشف هذه الورقة أن النماذج اللغوية الكبيرة تخلط بين الصلاحية المنطقية والمعقولية الدلالية لأن هذه المفاهيم متوافقة خطياً في تمثيلاتها الداخلية، وتُظهر أن تطبيق نواقل التوجيه لفك الارتباط بينهما يمكن أن يقلل بفعالية من تحيزات المحتوى ويحسن دقة الاستدلال.

Leonardo Bertolazzi, Sandro Pezzelle, Raffaella Bernardi2026-04-21
💬 NLP

Don't Adapt Small Language Models for Tools; Adapt Tool Schemas to the Models

تقدم هذه الورقة PA-Tool، وهي طريقة لا تتطلب تدريبًا تعمل على تحسين دقة استخدام الأدوات في النماذج اللغوية الصغيرة من خلال تكييف مخططات الأدوات لتتطابق مع المعرفة المسبقة للنماذج، مما يقلل أخطاء عدم تطابق المخططات بنسبة تصل إلى 80% دون الحاجة إلى إعادة تدريب النموذج.

Jonggeun Lee, Woojung Song, Jongwook Han, Haesung Pyun, Yohan Jo2026-04-21