💬 NLP

DeEscalWild: A Real-World Benchmark for Automated De-Escalation Training with SLMs

تقدم هذه الورقة DeEscalWild، وهي مجموعة بيانات مرجعية مبتكرة تتكون من 1,500 سيناريو عالي الدقة للتفاعلات بين الشرطة والمدنيين تم تجميعها من فيديوهات مفتوحة المصدر، مما يمكّن النماذج اللغوية الصغيرة (SLMs) من تحقيق أداء فائق في خفض التصعيد مقارنة بالنماذج العامة الأكبر حجماً، مع العمل بكفاءة على الأجهزة الطرفية المحمولة لتدريب إنفاذ القانون في العالم الحقيقي.

Md Hasebul Hasan, Krity Haque Charu, Eshwara Prasad Sridhar, Shuchisnigdha Deb, Mohammad A. Islam2026-04-16
💬 NLP

Document-tuning for robust alignment to animals

تقدم هذه الورقة "معيار أذى الحيوان" (Animal Harm Benchmark) وتثبت أن الضبط الدقيق للنماذج اللغوية باستخدام وثائق اصطناعية يحسن بشكل كبير من توافقها مع التعاطف مع الحيوان، رغم أن هذا التدخل القيمي هش ويتدهور تحت تأثير الضبط الدقيق للتعليمات غير ذات الصلة دون استراتيجيات حفظ صريحة.

Jasmine Brazilek, Miles Tidmarsh2026-04-16
💬 NLP

InfiniteScienceGym: An Unbounded, Procedurally-Generated Benchmark for Scientific Analysis

تقدم الورقة البحثية InfiniteScienceGym، وهو معيار يتم إنشاؤه إجرائياً لإنشاء مستودعات علمية ذاتية الاحتواء مع أسئلة قابلة للتحقق لتقييم قدرة النماذج اللغوية الكبيرة على الاستدلال القائم على الأدلة واستخدام الأدوات، مما يكشف أن النماذج الحالية تعاني في الدقة وتحديد الاستعلامات غير القابلة للإجابة.

Oliver Bentham, Vivek Srikumar2026-04-16
💬 NLP

Evaluating the Evaluator: Problems with SemEval-2020 Task 1 for Lexical Semantic Change Detection

تعيد هذه الورقة البحثية تقييم مهمة SemEval-2020 Task 1، وهي المعيار الرائد للكشف عن التغير الدلالي المعجمي، تقييماً نقدياً من خلال تحديد أوجه القصور الكبيرة في تضييق نطاق تشغيل مفهوم التغير، ومشكلات جودة البيانات الجوهرية، والخيارات التصميمية المقيدة، محاججةً في نهاية المطاف بوجوب اعتبارها أداة جزئية بدلاً من كونها مقياساً نهائياً للتقدم، مع الدعوة إلى تحسينات مستقبلية في النظرية والشفافية والنطاق.

Bach Phan-Tat, Kris Heylen, Dirk Geeraerts, Stefano De Pascale, Dirk Speelmana2026-04-16
💬 NLP

Hessian-Enhanced Token Attribution (HETA): Interpreting Autoregressive LLMs

تقدم هذه الورقة البحثية إطار عمل "نسب الرموز المعزز بهيسيان" (HETA)، وهو إطار عمل مبتكر مصمم لتحسين قابلية التفسير للنماذج اللغوية ذات التوليد الذاتي القائمة على فك التشفير فقط، وذلك عبر الجمع بين ناقلات الانتقال الدلالي، ودرجات الحساسية القائمة على مصفوفة هيسيان، وتباعد كولباك-ليبلر لإنتاج نسب رموز أكثر أمانة وتوافقاً مع الإدراك البشري، إلى جانب معيار جديد لتقييم جودة النسب التوليدي.

Vishal Pramanik, Maisha Maliha, Nathaniel D. Bastian, Sumit Kumar Jha2026-04-16
💬 NLP

Indexing Multimodal Language Models for Large-scale Image Retrieval

تقترح هذه الورقة نهجاً لا يتطلب تدريباً يستفيد من النماذج اللغوية الكبيرة متعددة الوسائط (MLLMs) كأدوات لتقدير التشابه بنمط "التعلم الصفري" لاسترجاع الصور واسع النطاق، مما يثبت متانتها الفائقة تجاه التحديات البصرية وفعاليتها كبديل لأدوات إعادة الترتيب المتخصصة دون الحاجة إلى الضبط الدقيق.

Bahey Tharwat, Giorgos Kordopatis-Zilos, Pavel Suma, Ian Reid, Giorgos Tolias2026-04-16
💬 NLP

L2D-Clinical: Learning to Defer for Adaptive Model Selection in Clinical Text Classification

تقدم الورقة البحثية L2D-Clinical، وهو إطار عمل يختار تكيفياً بين نماذج BERT المتخصصة والنماذج اللغوية الكبيرة (LLMs) العامة لتصنيف النصوص السريرية من خلال تعلم التأجيل فقط عندما تقدم النماذج اللغوية الكبيرة أداءً فائقاً، مما يؤدي إلى تحسين الدقة مع تقليل تكاليف واجهة برمجة التطبيقات (API).

Rishik Kondadadi, John E. Ortega2026-04-16
💬 NLP

English is Not All You Need: Systematically Exploring the Role of Multilinguality in LLM Post-Training

تُظهر هذه الورقة بشكل منهجي أن دمج البيانات متعددة اللغات أثناء مرحلة ما بعد التدريب للنماذج اللغوية الكبيرة يعزز الأداء بشكل كبير عبر جميع اللغات، بما في ذلك الإنجليزية، وأن حتى التضمين الأدنى للغات غير الإنجليزية يعد أفضل من النهج المقتصر على الإنجليزية فقط، لا سيما بالنسبة للغات ذات الموارد المنخفضة.

Mehak Dhaliwal, Shashwat Chaurasia, Yao Qin, Dezhi Hong, Thomas Butler2026-04-16
💬 NLP

Giving Voice to the Constitution: Low-Resource Text-to-Speech for Quechua and Spanish Using a Bilingual Legal Corpus

تقدم هذه الورقة مساراً موحداً يستخدم ثلاث بنيات متطورة لتحويل النص إلى كلام (TTS) لتخليق كلام عالي الجودة باللغتين الكيتشوا والإسبانية للدستور البيروفي، مع الاستفيد من النقل عبر اللغات للتغلب على ندرة البيانات في لغة الكيتشوا ذات الموارد المنخفضة، مع توفير موارد مفتوحة المصدر لتقنيات الخطاب القانوني الشامل.

John E. Ortega, Rodolfo Zevallos, Fabricio Carraro2026-04-16
💬 NLP

AgentSPEX: An Agent SPecification and EXecution Language

تقدم الورقة البحثية AgentSPEX، وهي لغة ونطاق تنفيذ خاص بمجال محدد يتيحان توصيف سير عمل وكلاء النماذج اللغوية الكبيرة (LLM) مع تحكم صريح في تدفق التحكم، وبنية نمطية، وإدارة للحالة، مما يوفر بديلاً أكثر قابلية للتفسير والصيانة لأدوات التنسيق المرتبطة بلغة بايثون الحالية.

Pengcheng Wang, Jerry Huang, Jiarui Yao, Rui Pan, Peizhi Niu, Yaowenqi Liu, Ruida Wang, Renhao Lu, Yuwei Guo, Tong Zhang2026-04-16