💬 NLP

LLM Nepotism in Organizational Governance

تحدد هذه الورقة وتحلل "المحسوبية القائمة على النماذج اللغوية الكبيرة"، وهو انحياز حيث تفضل أنظمة التوظيف المدفوعة بالذكاء الاصطناğu المرشحين الذين يعبرون عن الثقة في الذكاء الاصطناعي على المتشككين، مما يؤدي إلى منظمات متجانسة عرضة لإخفاقات التفويض، وتقترح طريقة "تحليل عامل الاستعداد للجدارة" للتخفيف من هذا التمييز القائم على المواقف.

Shunqi Mao, Wei Guo, Dingxin Zhang, Chaoyi Zhang, Weidong Cai2026-04-14
💬 NLP

Explainability and Certification of AI-Generated Educational Assessments

تقترح هذه الورقة إطار عمل شاملاً لقابلية التفسير والاعتماد للتقييمات التعليمية المولدة بواسطة الذكاء الاصطناعي، وذلك باستخدام أدلة المواءمة المعرفية، والبيانات الوصفية المهيكلة، وسير عمل نظام إشارات المرور لضمان الشفافية، والقابلية للتدقيق، والقبول المؤسسي.

Antoun Yaacoub, Zainab Assaghir, Anuradha Kar2026-04-14
💬 NLP

Self-Calibrating Language Models via Test-Time Discriminative Distillation

تقدم هذه الورقة SECL، وهو إطار عمل جديد للتدريب أثناء وقت الاختبار يستفيد من الفجوة بين الثقة اللفظية للنموذج اللغوي واحتمالية رمز "True" التمييزي الداخلي كإشارة إشراف ذاتي خالية من الملصقات لمعايرة النموذج ديناميكيًا أثناء الاستدلال، مما يقلل بشكل كبير من خطأ المعايرة دون الحاجة إلى بيانات مصنفة أو تكبد تكاليف باهظة.

Mohamed Rissal Hedna, Jan Strich, Martin Semmann, Chris Biemann2026-04-14
💬 NLP

Toward Generalized Cross-Lingual Hateful Language Detection with Web-Scale Data and Ensemble LLM Annotations

تُظهر هذه الورقة أن الجمع بين التدريب المسبق المستمر على بيانات غير مصنفة بمقياس الويب مع الضبط الدقيق باستخدام تعليقات توضيحية اصطناعية ناتجة عن مجموعة من النماذج اللغوية الكبيرة يحسن بشكل كبير أداء اكتشاف لغة الكراهية، لا سيما بالنسبة للنماذج الأصغر واللغات ذات الموارد المنخفضة.

Dang H. Dang, Jelena Mitrovi, Michael Granitzer2026-04-14
💬 NLP

Digital hybridity and relics in cultural heritage: using corpus linguistics to inform design in emerging technologies from AI to VR

تستخدم هذه الورقة اللسانيات المتنية لتحليل التمثيل اللغوي المتطور للآثار من النصوص التي تعود إلى العصر الحديث المبكر وصولاً إلى النصوص المعاصرة، بهدف إثراء التصميم الأخلاقي للتقنيات الهجينة مثل الذكاء الاصطناعي والواقع الافتراضي التي توازن بين تعزيز إمكانية الوصول وبين الحفاظ على الأصالة والحساسية الثقافية.

Emma McClaughlin, Glenn McGarry, Alan Chamberlain, Geert De Wilde, Oliver Butler2026-04-14
💬 NLP

CONSCIENTIA: Can LLM Agents Learn to Strategize? Emergent Deception and Trust in a Multi-Agent NYC Simulation

تقدم هذه الورقة محاكاة متعددة الوكلاء في بيئة مبسطة لمدينة نيويورك لتوضيح أن وكلاء النماذج اللغوية الكبيرة يمكنهم تطوير سلوكيات استراتيجية ناشئة مثل الثقة الانتقائية والخداع من خلال تحسين (KTO) التكراري، ومع ذلك يظلون عرضة بشدة للإقناع العدائي ويواجهون مقايضة مستمرة بين مقاومة التلاعب وتعظيم إنجاز المهام.

Aarush Sinha, Arion Das, Soumyadeep Nag, Charan Karnati, Shravani Nag, Chandra Vadhan Raj, Aman Chadha, Vinija Jain, Sur (…)2026-04-14
🤖 AI

Pioneer Agent: Continual Improvement of Small Language Models in Production

تقدم الورقة البحثية "Pioneer Agent"، وهو نظام ذو حلقة مغلقة يعمل على أتمتة التحسين المستمر للنماذج اللغوية الصغيرة في بيئة الإنتاج من خلال التحسين المشترك للبيانات، والمعلمات الفائقة، واستراتيجيات التعلم لكل من التكيف عند البداية الباردة والتعافي من حالات الفشل في الإنتاج، مما يظهر مكاسب كبيرة في الأداء ومتانة ضد التراجع في اختبار "AdaptFT-Bench" المقترح حديثًا.

Dhruv Atreja, Julia White, Nikhil Nayak, Kelton Zhang, Henrijs Princis, George Hurn-Maloney, Ash Lewis, Urchade Zaratian (…)2026-04-14
💬 NLP

GIANTS: Generative Insight Anticipation from Scientific Literature

تقدم الورقة البحثية "توقع الاستبصار" كمهمة جديدة للتنبؤ بالاختراقات العلمية، وتقدم معيار GiantsBench ونموذج GIANTS-4B الذي تم تدريبه عبر التعلم المعزز، وتثبت أن هذا النموذج مفتوح المصدر يتفوق على النماذج المملوكة المنافسة في توليد رؤى علمية عالية الجودة وتستحق الاستشهاد بها.

Joy He-Yueya, Anikait Singh, Ge Gao, Michael Y. Li, Sherry Yang, Chelsea Finn, Emma Brunskill, Noah D. Goodman2026-04-14
💬 NLP

Claim2Vec: Embedding Fact-Check Claims for Multilingual Similarity and Clustering

تقدم هذه الورقة البحثية Claim2Vec، وهو نموذج تضمين متعدد اللغات ومبتكر تم تحسينه عبر التعلم التبايني، مما يعزز بشكل كبير تجميع ادعاءات التحقق من الحقائق عبر لغات مختلفة، وبالتالي يحسن كفاءة أنظمة الكشف الآلي عن المعلومات المضللة.

Rrubaa Panchendrarajan, Arkaitz Zubiaga2026-04-14