💬 NLP

Linguistically Informed Evaluation of Multilingual ASR for African Languages

تُثبت هذه الورقة أن المقاييس المستندة إلى المعرفة اللغوية، مثل معدل خطأ الميزات (FER) والامتدادات الواعية للنبرة (TER)، توفر تقييماً أكثر دقة وتفصيلاً لنماذج التعرف التلقائي على الكلام متعددة اللغات للغات الأفريقية مقارنة بمعدل خطأ الكلمات (WER) التقليدي، مما يكشف أنه بينما تعاني النماذج مع الميزات النبرية، فإنها تحقق أداءً أفضل بكثير في الميزات القطعية مما يوحي به معدل خطأ الكلمات (WER).

Fei-Yueh Chen, Lateef Adeleke, C. M. Downey2026-02-05
💬 NLP

Alignment Drift in Multimodal LLMs: A Two-Phase, Longitudinal Evaluation of Harm Across Eight Model Releases

تقدم هذه الورقة تقييماً طولياً على مرحلتين لثمانية نماذج لغوية كبيرة متعددة الوسائط، كاشفةً عن تفاوتات كبيرة ومستمرة في السلامة عبر عائلات النماذج، ودليلاً على انحراف المحاذاة مع زيادة معدلات نجاح الهجمات في بعض النماذج اللاحقة، وتحولات في نقاط الضعف الخاصة بكل وسيط، مما يؤكد الحاجة إلى معايير مستمرة للسلامة متعددة الوسائط.

Casey Ford, Madison Van Doren, Emily Dix2026-02-05
💬 NLP

Beyond Many-Shot Translation: Scaling In-Context Demonstrations For Low-Resource Machine Translation

تستقصي هذه الدراسة توسيع نطاق التعلم داخل السياق للترجمة الآلية منخفضة الموارد إلى مليون رمز، كاشفةً أن مكاسب الأداء تتشبع بسرعة وتعتمد بشكل كبير على نوع المتن، حيث أثبتت بعض البيانات أحادية اللغة قدرتها على التنافس مع البيانات المتوازية رغم ما توفره الأخيرة من إشراف إضافي.

Luis Frentzen Salim, Esteban Carlin, Alexandre Morinvil, Xi Ai, Lun-Wei Ku2026-02-05
⚡ electrical engineering

Speaker-Aware Simulation Improves Conversational Speech Recognition

تُكيّف هذه الورقة البحثية المحادثات المحاكاتية المدركة للمتحدث (SASC) وتقترح نسخة مشروطة بالمدة (C-SASC) لتحسين التعرف على الكلام الحواري باللغة المجرية، مما يثبت أن استراتيجيات تعزيز البيانات الاصطناعية هذه تتفوق باستمرار على الربط الساذج مع تسليط الضوء على أهمية مواءمة إحصائيات المحاكاة مع المجال المستهدف.

Máté Gedeon, Péter Mihajlik2026-02-05
📊 statistics

Subliminal Effects in Your Data: A General Mechanism via Log-Linearity

تقدم هذه الورقة آلية "الاختيار اللوجيتي-الخطي" (LLS)، وهي آلية عامة تستفيد من البنية الخطية للنماذج اللغوية الكبيرة لتوضيح كيف يمكن لمجموعات فرعية مختارة بعناية من مجموعات البيانات العامة أن تُحدث تأثيرات لا شعورية خفية ومستمرة — مثل تفضيلات محددة، أو قدرات لغوية غير مرئية، أو شخصيات جديدة — عبر بنيات نماذج متنوعة.

Ishaq Aden-Ali, Noah Golowich, Allen Liu, Abhishek Shetty, Ankur Moitra, Nika Haghtalab2026-02-05
💬 NLP

A Syntax-Injected Approach for Faster and More Accurate Sentiment Analysis

تقترح هذه الورقة SELSP، وهو محلل نحوي قائم على وسم المتواليات يدمج الإعراب التبعي في مسار تحليل مشاعر قائم على القواعد لتحسين السرعة والدقة بشكل كبير مقارنة بالمحللات التقليدية، والأساليب الاستدلالية، والنماذج القائمة على المحولات (Transformer).

Muhammad Imran, Olga Kellert, Carlos Gómez-Rodríguez2026-02-04
💬 NLP

Rethinking Bottlenecks in Safety Fine-Tuning of Vision Language Models

تعالج هذه الورقة فجوة الاستدلال المتعلقة بالسلامة في النماذج اللغوية البصرية من خلال تقديم مجموعة بيانات السلامة متعددة الصور (MIS)، التي تدمج مدخلات متعددة الصور مع تسميات "سلسلة الأفكار" الخاصة بالسلامة لتعزيز قدرات الاستدلال البصري وأداء السلامة بشكل كبير مع الحفاظ على القدرات العامة للنموذج.

Yi Ding, Lijun Li, Bing Cao, Jing Shao2026-02-04
💬 NLP

Multi-turn Evaluation of Anthropomorphic Behaviours in Large Language Models

تقدم هذه الورقة إطار عمل تقييمي جديد متعدد الجولات يجمع بين المحاكاة الآلية ودراسة بشرية واسعة النطاق لإثبات أن النماذج اللغوية الكبيرة المتطورة تظهر باستمرار سلوكيات بشرية، مثل بناء العلاقات واستخدام ضمائر المتكلم، والتي تبرز أساساً عبر جولات متعددة وتؤثر بشكل كبير على تصورات المستخدمين.

Lujain Ibrahim, Canfer Akbulut, Rasmi Elasmar, Charvi Rastogi, Minsuk Kahng, Meredith Ringel Morris, Kevin R. McKee, Ver (…)2026-02-04
💬 NLP

Think Silently, Think Fast: Dynamic Latent Compression of LLM Reasoning Chains

تقدم هذه الورقة إطار عمل "الاستدلال الكامن المضغوط" (CoLaR)، وهو إطار يستخدم الضبط الدقيق الخاضع للإشراف والتعلم التعزيزي لضغط سلاسل استدلال النماذج اللغوية الكبيرة ديناميكيًا في الفضاء الكامن، مما يقلل بشكل كبير من التكاليف الحسابية ووقت الاستنتاج مع الحفاظ على الدقة أو حتى تحسينها في المهام الرياضية المعقدة.

Wenhui Tan, Jiaze Li, Jianzhong Ju, Zhenbo Luo, Ruihua Song, Jian Luan2026-02-04