💬 NLP

Triggers Hijack Language Circuits: A Mechanistic Analysis of Backdoor Behaviors in Large Language Models

تقدم هذه الورقة أول تحليل ميكانيكي للأبواب الخلفية لتبديل اللغات في النماذج اللغوية الكبيرة، كاشفةً أن رؤوس الانتباه التي يتم تفعيلها بواسطة المحفز تتداخل بشكل كبير مع دوائر معالجة اللغة الطبيعية، مما يشير إلى أن الأبواب الخلفية تستولي على مكونات النموذج الموجودة بدلاً من تشكيل آليات معزولة.

Théo Lasnier, Wissam Antoun, Francis Kulumba, Djamé Seddah2026-02-16
💬 NLP

Targeted Syntactic Evaluation of Language Models on Georgian Case Alignment

تقيم هذه الورقة النماذج اللغوية القائمة على المحولات في حالة التوافق الإعرابي المتبادل (split-ergative) للغة الجورجية باستخدام مجموعة بيانات تم إنشاؤها حديثاً تتكون من 370 زوجاً أدنى، مما يكشف أن النماذج تعاني أكثر مع حالة الرفع الإرغاتي (ergative case) النادرة بسبب انخفاض وتيرة ظهورها وندرة البيانات، بينما تؤدي بشكل أفضل في حالة الرفع الاسمية (nominative case) الأكثر شيوعاً.

Daniel Gallagher, Gerhard Heyer2026-02-16
💬 NLP

Detecting Overflow in Compressed Token Representations for Retrieval-Augmented Generation

تتناول هذه الورقة تحدي فقدان المعلومات في تمثيلات الرموز (tokens) المضغوطة لعمليات التوليد المعزز بالاسترجاع، وذلك عبر تعريف "تجاوز الرموز" (token overflow) وإثبات أن مصنفات الاستقصاء خفيفة الوزن والمدركة للاستعلام يمكنها اكتشاف هذا النمط بدقة عالية، مما يتيح معالجة مسبقة منخفضة التكلفة للتخفيف من الأخطاء الناجمة عن الضغط.

Julia Belikova, Danila Rozhevskii, Dennis Svirin, Konstantin Polev, Alexander Panchenko2026-02-16
💬 NLP

From Biased Chatbots to Biased Agents: Examining Role Assignment Effects on LLM Agent Robustness

تقدم هذه الورقة أول دراسة منهجية تثبت أن تعيينات الشخصيات القائمة على الديموغرافيا يمكن أن تؤدي إلى تدهور كبير في أداء وموثوقية وكلاء النماذج اللغوية الكبيرة عبر مجالات متنوعة، مما يكشف عن ثغرة حرجة حيث تسبب الإشارات غير ذات الصلة بالمهمة تحيزات سلوكية وتقلبات في اتخاذ القرار.

Linbo Cao, Lihao Sun, Yang Yue2026-02-16
⚡ electrical engineering

Beyond Musical Descriptors: Extracting Preference-Bearing Intent in Music Queries

تقدم هذه الورقة البحثية MusicRecoIntent، وهو متن من طلبات الموسيقى المشروحة من موقع Reddit والتي تصنف الواصفات الحاملة للتفضيلات للكشف عن قصد المستخدم، وتقيم قدرة النماذج اللغوية الكبيرة على استخراج هذه الإشارات الصريحة والسياقية لتحسين أنظمة توصية الموسيقى.

Marion Baranes, Romain Hennequin, Elena V. Epure2026-02-16
💬 NLP

Think Fast and Slow: Step-Level Cognitive Depth Adaptation for LLM Agents

تقدم هذه الورقة CogRouter، وهو إطار عمل يعزز كفاءة وأداء وكلاء النماذج اللغوية الكبيرة (LLM) في المهام طويلة المدى من خلال التكيف ديناميكيًا مع العمق المعرفي في كل خطوة عبر عملية تدريب ثنائية المراحل قائمة على نظرية ACT-R، محققًا نتائج رائدة مع تقليل استهلاك الرموز (tokens) بشكل كبير.

Ruihan Yang, Fanghua Ye, Xiang We, Ruoqing Zhao, Kang Luo, Xinbo Xu, Bo Zhao, Ruotian Ma, Shanyi Wang, Zhaopeng Tu, Xiao (…)2026-02-16
💬 NLP

X\mathcal{X}-KD: General Experiential Knowledge Distillation for Large Language Models

تقترح الورقة البحثية X\mathcal{X}-KD، وهو إطار عمل عام لتقطير المعرفة مستوحى من التعلم التجريبي والتعلم التعزيزي العكسي، يُمكّن النماذج الطلابية من التعلم من بيئة التعلم الأصلية للمعلم عبر النمذجة المشتركة لدالة المكافأة والسياسة الخاصة بالمعلم، مما يحقق أداءً وتنوعاً وكفاءة في البيانات متفوقة عبر مهام متنوعة مقارنة بالنماذج المرجعية الحالية.

Yuang Cai, Yuyu Yuan2026-02-16
⚡ electrical engineering

Lamer-SSL: Layer-aware Mixture of LoRA Experts for Continual Multilingual Expansion of Self-supervised Models without Forgetting

تقترح الورقة البحثية Lamer-SSL، وهو إطار عمل فعال من حيث المعلمات يجمع بين مزيج من خبراء LoRA المدركين للطبقات مع استراتيجية إعادة التشغيل لتمكين التوسع المستمر متعدد اللغات لنماذج الكلام ذات التعلم الذاتي مع منع النسيان الكارثي بشكل فعال.

Jing Xu, Minglin Wu, Xueyuan Chen, Xixin Wu, Helen Meng2026-02-16
💬 NLP

AIWizards at MULTIPRIDE: A Hierarchical Approach to Slur Reclamation Detection

تقدم هذه الورقة نهجاً هرمياً للكشف عن الألفاظ النابية المستردة في مهمة MultiPRIDE المشتركة، وذلك عبر استخدام تعليقات النماذج اللغوية الكبيرة (LLM) الخاضعة للإشراف الضعيف أولاً لاستنتاج الانتماء لمجتمع LGBTQ+ من ملفات المستخدمين وتغريداتهم، ثم دمج هذه الإشارات اللغوية الاجتماعية في نموذج قائم على BERT للتمييز بفعالية بين الإساءة والتأكيد داخل المجموعة للألفاظ النابية باللغتين الإيطالية والإسبانية.

Luca Tedeschini, Matteo Fasulo2026-02-16