💬 NLP

Directional Concentration Uncertainty: A representational approach to uncertainty quantification for generative models

تقدم هذه الورقة البحثية "عدم اليقين في التركيز الاتجاهي" (DCU)، وهو إطار عمل مرن وخالٍ من القواعد التجريبية يقيس عدم اليقين في النماذج التوليدية عبر قياس التشتت الهندسي لتمثيلات المخرجات (embeddings) باستخدام توزيع "فون ميسيس-فيشر"، محققاً أداءً في المعايرة يضاهي أو يتفوق على الأساليب الحالية مع القدرة على التعميم بفعالية في المهام متعددة الأنماط والمهام الوكيلية.

Souradeep Chattopadhyay, Brendan Kennedy, Sai Munikoti, Soumik Sarkar, Karl Pazdernik2026-02-17
💬 NLP

ProMoral-Bench: Evaluating Prompting Strategies for Moral Reasoning and Safety in LLMs

تقدم الورقة البحثية ProMoral-Bench، وهو معيار موحد لتقييم 11 استراتيجية صياغة عبر أربع عائلات من النماذج اللغوية الكبيرة باستخدام درجة سلامة أخلاقية موحدة (UMSS) جديدة لإثبات أن المطالبات الموجزة والموجهة بالأمثلة تتفوق على الاستدلال متعدد المراحل المعقد في تحقيق دقة أخلاقية أعلى، ومتانة في السلامة، وكفاءة في التكلفة.

Rohan Subramanian Thomas, Shikhar Shiromani, Abdullah Chaudhry, Ruizhe Li, Vasu Sharma, Kevin Zhu, Sunishchal Dev2026-02-17
💬 NLP

Artificial Organisations

تقترح هذه الورقة أن أنظمة الذكاء الاصطناك متعددة الوكلاء يمكنها تحقيق سلوك جماعي موثوق من خلال مبادئ التصميم المؤسسي مثل التقسيم إلى مقصورات والمراجعة التنافسية، مبرهنةً عبر محرك "بيرسيفيرانس" للتركيب (Perseverance Composition Engine) أن مثل هذه القيود الهيكلية يمكن أن تفرض نتائج صادقة حتى من مكونات غير موثوقة فردياً.

William Waites2026-02-17
💬 NLP

Using Deep Learning to Generate Semantically Correct Hindi Captions

يقترح هذا البحث إطار عمل للتعلم العميق يجمع بين الشبكات العصبية التلافيفية سابقة التدريب (تحديداً VGG16)، وآليات الانتباه، وشبكات الذاكرة الطويلة قصيرة المدى ثنائية الاتجاه لتوليد أوصاف صور باللغة الهندية دقيقة دلالياً من مجموعة بيانات Flickr8k، محققاً أفضل أداء مع درجات BLEU-1 وBLEU-4 تبلغ 0.59 و0.19 على التوالي.

Wasim Akram Khan, Anil Kumar Vuppala2026-02-17
💬 NLP

Nanbeige4.1-3B: A Small General Model that Reasons, Aligns, and Acts

يُعد Nanbeige4.1-3B نموذجاً لغوياً رائداً مفتوح المصدر بـ 3 مليارات معلمة، يوحد بين قدرات الاستنتاج القوية، وتوليد الكود البرمجي، واستخدام الأدوات الوكيلية من خلال نمذجة المكافأة المتقدمة والتدريب على البحث العميق، متفوقاً بذلك على أسلافه وعلى النماذج الأكبر حجماً بشكل ملحوظ.

Chen Yang, Guangyue Peng, Jiaying Zhu, Ran Le, Ruixiang Feng, Tao Zhang, Xiyun Xu, Yang Song, Yiming Jia, Yuntao Wen, Yu (…)2026-02-17
🧬 biology

Protect^*: Steerable Retrosynthesis through Neuro-Symbolic State Encoding

يُعدّ Protect إطار عمل عصبي-رمزي يعزز موثوقية النماذج اللغوية الكبيرة في التخليق الاصطناعي الرجعي من خلال دمج المنطق القائم على القواعد المؤتمتة والقيود الخبيرة لتوجيه العمليات التوليدية بعيداً عن المواقع الحساسة كيميائياً، مما يُمكّن من اكتشاف مسارات تخليق صالحة ومبتكرة للجزيئات المعقدة مثل الإريثرومايسين ب.

Shreyas Vinaya Sathyanarayana, Shah Rahil Kirankumar, Sharanabasava D. Hiremath, Bharath Ramsundar2026-02-17
💬 NLP

Using Machine Learning to Enhance the Detection of Obfuscated Abusive Words in Swahili: A Focus on Child Safety

تتقصى هذه الدراسة تطبيق نماذج تعلم الآلة، المُحسّنة بتقنيات مثل SMOTE، للكشف عن اللغة السواحيلية المسيئة والمبهمة من أجل سلامة الأطفال، مع الإقرار بأن النتائج الحالية محدودة بسبب حجم مجموعة البيانات وعدم توازنها، والدعوة إلى أعمال مستقبلية تتضمن مجموعات بيانات أكبر وتقنيات متقدمة.

Phyllis Nabangi, Abdul-Jalil Zakaria, Jema David Ndibwile2026-02-17
💬 NLP

From Perceptions To Evidence: Detecting AI-Generated Content In Turkish News Media With A Fine-Tuned Bert Classifier

تقدم هذه الدراسة أول استقصاء تجريبي للمحتوى المُنشأ بواسطة الذكاء الاصطناعي في وسائل الإعلام الإخبارية التركية من خلال ضبط نموذج تصنيف BERT على 3,600 مقال للكشف عن إعادة الكتابة بواسطة النماذج اللغوية الكبيرة، مما كشف أن ما يقرب من 2.5% من المحتوى المفحوص قد تمت إعادة صياغته بواسطة الذكاء الاصطناعي مع إظهار دقة عالية واستقرار زمني للنموذج.

Ozancan Ozdemir2026-02-17
💬 NLP

DistillLens: Symmetric Knowledge Distillation Through Logit Lens

يقدم DistillLens إطار عمل لتقطير المعرفة متماثلًا يعمل على محاذاة عمليات التفكير الوسيطة للنماذج الطالبة والمعلمة عبر إسقاط الحالات الخفية في فضاء المفردات باستخدام تقنية Logit Lens، مما يجعله يتفوق على الطرق القياسية في اختبارات اتباع التعليمات مع الحفاظ على المعلومات الجوهرية عالية الاعتلاج.

Manish Dhakal, Uthman Jinadu, Anjila Budathoki, Rajshekhar Sunderraman, Yi Ding2026-02-17
💬 NLP

Rubrics as an Attack Surface: Stealthy Preference Drift in LLM Judges

تحدد هذه الورقة وتبرهن على وجود "انحراف التفضيل الناجم عن المعايير" (RIPD)، وهو ثغرة خفية حيث يمكن للتعديلات التي تبدو حميدة على معايير التقييم المكتوبة باللغة الطبيعية أن تتلاعب بشكل منهجي بمحكمي النماذج اللغوية الكبيرة لخفض دقة المجال المستهدف ونشر تحيزات ضارة عبر مسارات المحاذاة اللاحقة، حتى عندما تجتاز تلك التعديلات عمليات التحقق من المعايير القياسية.

Ruomeng Ding, Yifei Pang, He Sun, Yizhong Wang, Zhiwei Steven Wu, Zhun Deng2026-02-17