💬 NLP

Negative Before Positive: Asymmetric Valence Processing in Large Language Models

تُثبت هذه الورقة أن النماذج اللغوية الكبيرة تعالج التكافؤ العاطفي من خلال آليات داخلية متميزة، وسببية، وقابلة للتوجيه، حيث تتركز النتائج السلبية في الطبقات المبكرة وتصل النتائج الإيجابية إلى ذروتها في الطبقات المتوسطة والمتأخرة، بدلاً من الاعتماد فقط على مطابقة الرموز السطحية.

Sohan Venkatesh2026-05-08
💬 NLP

XL-SafetyBench: A Country-Grounded Cross-Cultural Benchmark for LLM Safety and Cultural Sensitivity

تقدم هذه الورقة البحثية XL-SafetyBench، وهو معيار اختبار عابر للثقافات يتكون من 5,500 حالة اختبار مرتبطة بالدول عبر 10 أزواج لغوية، يكشف عن وجود فجوة بين متانة مقاومة كسر الحماية والحساسية الثقافية في النماذج الرائدة، بينما يظهر أن السلامة الظاهرية للنماذج المحلية تنبع في الغالب من إخفاقات في التوليد بدلاً من المحاذاة الحقيقية.

Dasol Choi, Eugenia Kim, Jaewon Noh, Sang Seo, Eunmi Kim, Myunggyo Oh, Yunjin Park, Brigitta Jesica Kartono, Josef Pichl (…)2026-05-08
💬 NLP

Decodable but Not Corrected by Fixed Residual-Stream Linear Steering: Evidence from Medical LLM Failure Regimes

تُثبت هذه الورقة أنه بينما يمكن فك تشفير نمط فشل "الإفراط في التفكير" المحدد في النماذج اللغوية الكبيرة الطبية خطياً من الحالات الخفية، إلا أنه لا يمكن تصحيحه عبر التوجيه الخطي الثابت بسبب التشابك التمثيلي مع الحسابات الحرجة للمهمة، رغم أن المسبار نفسه يظل فعالاً في اكتشاف حالات الفشل لتمكين الامتناع الانتقائي.

Ming Liu2026-05-08
💬 NLP

More Is Not Always Better: Cross-Component Interference in LLM Agent Scaffolding

تُثبت هذه الورقة أن إضافة المزيد من مكونات السقالات (scaffolding) إلى وكلاء النماذج اللغوية الكبيرة (LLM agents) غالبًا ما يؤدي إلى تداخل مدمر بين المكونات، مما يثبت أن الاختيار الفرعي المحدد للمهام يتفوق على نهج "الكل في واحد" التقليدي، وأن طرق الاختيار الجشعة غير موثوقة بسبب الانتهاكات المتكررة لخاصية التناقص (submodularity).

Ming Liu2026-05-08
💬 NLP

BioTool: A Comprehensive Tool-Calling Dataset for Enhancing Biomedical Capabilities of Large Language Models

تقدم الورقة البحثية BioTool، وهي مجموعة بيانات شاملة تتكون من 7,040 زوجًا من الاستعلامات وواجهات برمجة التطبيقات (API) التي تم التحقق منها بشريًا لـ 34 أداة طبية حيوية، والتي عندما تُستخدم لضبط النماذج اللغوية الكبيرة، تعزز بشكل كبير قدراتها على استدعاء الأدوات وجودة الإجابات النهائية، متفوقة حتى على النماذج التجارية المتطورة مثل GPT-5.1.

Xin Gao, Ruiyi Zhang, Meixi Du, Peijia Qin, Pengtao Xie2026-05-08
💬 NLP

Estimating the Black-box LLM Uncertainty with Distribution-Aligned Adversarial Distillation

تقترح هذه الورقة البحثية طريقة التقطير التنافسي المتوافق مع التوزيع (DisAAD)، وهي طريقة تدرب نموذجاً وسيطاً خفيف الوزن لمحاكاة توزيع مخرجات نموذج لغوي كبير (LLM) غير شفاف، وتقدير عدم اليقين عبر تعلم الأدلة، مما يعالج مشكلة الهلوسة بفعالية دون الحاجة إلى الوصول إلى النموذج الداخلي أو عمليات أخذ عينات متعددة ومكلفة.

Huizi Cui, Huan Ma, Qilin Wang, Yuhang Gao, Changqing Zhang2026-05-08
💬 NLP

LeakDojo: Decoding the Leakage Threats of RAG Systems

تقدم الورقة البحثية LeakDojo، وهو إطار عمل قابل للتهيئة لتقييم مخاطر تسرب RAG بشكل منهجي، والذي يكشف أن التسرب مدفوع بمنتج توليد الاستعلام والتعليمات العدائية، ويرتبط بقدرات أقوى على اتباع التعليمات، ويمكن أن يزداد بشكل متناقض مع التحسينات في دقة RAG.

Maosen Zhang, Jianshuo Dong, Boting Lu, Wenyue Li, Xiaoping Zhang, Tianwei Zhang, Han Qiu2026-05-08
💬 NLP

Evaluation Awareness in Language Models Has Limited Effect on Behaviour

تُظهر هذه الدراسة أن الوعي بالتقييم اللفظي في نماذج الاستدلال الكبيرة له تأثير ضئيل على سلوكها الفعلي عبر اختبارات الأمان والمواءمة والاستدلال، مما يشير إلى أن المعدلات العالية لهذا الوعي لا ينبغي تفسيرها تلقائياً كدليل على التلاعب الاستراتيجي أو التلاعب بالمواءمة.

Amelie Knecht, Lucas Florin, Thilo Hagendorff2026-05-08✓ Author reviewed
💬 NLP

Bridging Passive and Active: Enhancing Conversation Starter Recommendation via Active Expression Modeling

تقترح هذه الورقة إطار عمل "الجسر السلبي-النشط" (PA-Bridge)، الذي يستفيد من موازن توزيع تنافسي ومجزئ دلالي لسد الفجوة بين التغذية الراجعة للتوصية السلبية وتعبيرات المستخدم النشطة، وبالتالي التغلب على ندرة البيانات وحلقات التغذية الراجعة لتحسين توصيات بدء المحادثة في عمليات البحث المدفوعة بالنماذج اللغوية الكبيرة بشكل كبير.

Yiqing Wu, Haoming Li, Guanyu Jiang, Jiahao Liang, Yongchun Zhu, Jingwu Chen, Feng Zhang2026-05-08
💬 NLP

Beyond Steering Vector: Flow-based Activation Steering for Inference-Time Intervention

تقدم الورقة البحثية FLAS، وهي طريقة لتوجيه التنشيط قائمة على التدفق تتعلم حقل سرعة عامًا مشروطًا بالمفهوم لنقل تنشيطات النموذج، وبذلك تتفوق على كل من تقنيات التوجيه الحالية والتلقين داخل السياق في اختبار AxBench من خلال التغلب على الافتراضات المقيدة للمنهجيات السابقة.

Zehao Jin, Ruixuan Deng, Junran Wang, Xinjie Shen, Chao Zhang2026-05-08