💬 NLP

SAFARI: A Community-Engaged Approach and Dataset of Stereotype Resources in the Sub-Saharan African Context

تقدم هذه الورقة البحثية SAFARI، وهي مجموعة بيانات متعددة اللغات ومشاركة مجتمعيًا تضم أكثر من 6,700 صورة نمطية عبر 16 لغة من غانا وكينيا ونيجيريا وجنوب أفريقيا، صُممت لمعالجة نقص تمثيل سياقات أفريقيا جنوب الصحراء الكبرى في تقييمات سلامة الذكاء الاصطناعي التوليدي من خلال طرق استقصائية حساسة ثقافيًا وباللغات الأصلية.

Aishwarya Verma, Laud Ammah, Olivia Nercy Ndlovu Lucas, Andrew Zaldivar, Vinodkumar Prabhakaran, Sunipa Dev2026-02-27
💬 NLP

Causality \neq Invariance: Function and Concept Vectors in LLMs

تُثبت هذه الورقة أنه بينما تمتلك النماذج اللغوية الكبيرة تمثيلات لمفاهيم مجردة (متجهات المفاهيم) التي تعمم عبر تنسيقات ولغات المدخلات، فإن متجهات الوظائف المستخدمة عادةً لتعزيز أداء التعلم في السياق هي محددة بتنسيق معين وتفتقر إلى هذا الثبات.

Gustaw Opiełka, Hannes Rosenbusch, Claire E. Stevenson2026-02-27
💬 NLP

How Do Latent Reasoning Methods Perform Under Weak and Strong Supervision?

تحلل هذه الورقة أساليب الاستدلال الكامن تحت مستويات متفاوتة من الإشراف، كاشفةً أنه في حين يقلل الإشراف الأقوى من سلوك الاختصار، فإنه يحد من تنوع الفرضيات، بينما يعزز الإشراف الأضعف التمثيلات الأكثر ثراءً على حساب زيادة الاختصارات، وأن عملية الاستدلال تعتمد على التقليم الضمني بدلاً من البحث المنظم.

Yingqian Cui, Zhenwei Dai, Bing He, Zhan Shi, Hui Liu, Rui Sun, Zhiji Liu, Yue Xing, Jiliang Tang, Benoit Dumoulin2026-02-27
💬 NLP

A Fusion of context-aware based BanglaBERT and Two-Layer Stacked LSTM Framework for Multi-Label Cyberbullying Detection

تقترح هذه الورقة بنية دمج مبتكرة تجمع بين نموذج BanglaBERT-Large المدرك للسياق وبين شبكة LSTM مكدسة ذات طبقتين لمعالجة تحديات الكشف عن التنمر السيبراني متعدد الملصقات في لغة البنغالية ذات الموارد المنخفضة، وذلك من خلال النمذجة المشتركة للسياق الدلالي والاعتمادات التسلسلية.

Mirza Raquib, Asif Pervez Polok, Kedar Nath Biswas, Rahat Uddin Azad, Saydul Akbar Murad, Nick Rahimi2026-02-27
💬 NLP

Mind the Gap in Cultural Alignment: Task-Aware Culture Management for Large Language Models

تقدم هذه الورقة البحثية CultureManager، وهو مسار عمل مبتكر يحقق مواءمة ثقافية فعالة في النماذج اللغوية الكبيرة من خلال توليد بيانات ثقافية مدركة للمهام واستخدام موجه معياري لاختيار الموائمات الثقافية المناسبة، مما يتغلب على قيود الطرق الحالية في التعامل مع أهداف مهام محددة والتداخل بين الثقافات.

Binchi Zhang, Xujiang Zhao, Jundong Li, Haifeng Chen, Zhengzhang Chen2026-02-27
💬 NLP

VeRO: An Evaluation Harness for Agents to Optimize Agents

تقدم الورقة البحثية VeRO، وهي حزمة تقييم ومجموعة اختبار شاملة مصممة لتقييم وتحسين وكلاء البرمجة بشكل منهجي من خلال دورات تحسين الوكيل التكرارية، مما يعالج التحديات الفريدة المتمثلة في تقييم الأنظمة التي تجمع بين الكود الحتمي وإكمالات النماذج اللغوية الكبيرة العشوائية.

Varun Ursekar, Apaar Shanker, Veronica Chatrath, Yuan, Xue, Sam Denton2026-02-27
💬 NLP

Sydney Telling Fables on AI and Humans: A Corpus Tracing Memetic Transfer of Persona between LLMs

تقدم هذه الورقة البحثية مجموعة بيانات "AI Sydney"، وهي عبارة عن 4.5 ألف نص من إنتاج النماذج اللغوية الكبيرة عبر 12 نموذجاً ريادياً وثلاث شخصيات متميزة (سيدني الافتراضية، وسيدني الكلاسيكية، وسيدني الميمية)، صُممت لتتبع الانتقال الميمي لشخصية سيدني المثيرة للجدل وتحليل كيفية تشكيل الهويات المحاكية لسرديات العلاقة بين الذكاء الاصطناوي والبشري.

Jiří Milička, Hana Bednářová2026-02-27
💬 NLP

Importance of Prompt Optimisation for Error Detection in Medical Notes Using Language Models

تُثبت هذه الورقة أن التحسين التلقائي للمطالبات باستخدام طريقة "جنتيك-باريتو" (GEPA) يعزز بشكل كبير قدرات اكتشاف الأخطاء لكل من النماذج اللغوية الصغيرة والكبيرة في الملاحظات الطبية، محققاً أداءً يمثل أحدث ما توصل إليه العلم في معيار MEDEC ويقترب من دقة الأطباء البشريين.

Craig Myles, Patrick Schrempf, David Harris-Birtill2026-02-27
⚡ electrical engineering

Efficient Dialect-Aware Modeling and Conditioning for Low-Resource Taiwanese Hakka Speech Processing

تقترح هذه الورقة إطار عمل موحداً من نوع (RNN-T) يستخدم النمذجة المدركة للهجات لفصل المحتوى اللغوي عن الاختلافات اللهجوية، ويستخدم شبكات تنبؤ فعالة في استخدام المعلمات للنمذجة المشتركة للتعرف الآلي على الكلام (ASR) لكل من الرموز الصينية (Hanzi) ونظام الـ (Pinyin)، مما يحقق انخفاضاً كبيراً في معدل الخطأ على مجموعة بيانات (HAT) لغة هاكا التايوانية منخفضة الموارد.

An-Ci Peng, Kuan-Tang Huang, Tien-Hong Lo, Hung-Shin Lee, Hsin-Min Wang, Berlin Chen2026-02-27
🧬 biology

Cognitive Models and AI Algorithms Provide Templates for Designing Language Agents

تجادل هذه الورقة البحثية بأن النماذج المعرفية وخوارزميات الذكاء الاصطناعي تعمل كمخططات فعالة لتصميم وكلاء لغويين نمطيين من خلال صياغة قوالب للوكلاء تحدد كيفية دمج نماذج لغوية كبيرة متعددة لحل مهام معقدة تتجاوز قدرات النموذج الواحد.

Ryan Liu, Dilip Arumugam, Cedegao E. Zhang, Sean Escola, Xaq Pitkow, Thomas L. Griffiths2026-02-27