💬 NLP

Strategy Executability in Mathematical Reasoning: Leveraging Human-Model Differences for Effective Guidance

تحدد هذه الورقة فجوة حرجة بين استخدام استراتيجيات الاستدلال في الحلول الناجحة وقابليتها للتنفيذ عند تطبيقها كإرشادات، مما أدى إلى اقتراح "استرجاع الاستراتيجية الانتقائي" (SSR)، وهو إطار عمل يستفيد من الاختلافات بين البشر والنماذج لدمج الاستراتيجيات بشكل انتقائي وتحسين دقة الاستدلال الرياضي بشكل كبير عبر معايير قياس متنوعة.

Weida Liang, Yiyou Sun, Shuyuan Nan, Chuang Li, Dawn Song, Kenji Kawaguchi2026-02-27
💬 NLP

pQuant: Towards Effective Low-Bit Language Models via Decoupled Linear Quantization-Aware Training

تقترح الورقة البحثية pQuant، وهي طريقة جديدة للتدريب الواعي بالكمية تفصل الطبقات الخطية إلى فرع مهيمن ببت واحد وفرع خبير عالي الدقة يتم تنشيطه بشكل متفرق لمعالجة تجانس المعلمات وتحقيق أداء رائد في النماذج اللغوية ذات البتات المنخفضة للغاية.

Wenzheng Zhang, Bingzheng Liu, Yang Hu, Xiaoying Bai, Wentao Zhang, Bin Cui2026-02-27
💬 NLP

ContextRL: Enhancing MLLM's Knowledge Discovery Efficiency with Context-Augmented RL

تقترح الورقة البحثية ContextRL، وهو إطار عمل مبتكر يعزز كفاءة اكتشاف المعرفة في النماذج اللغوية الكبيرة متعددة الوسائط (MLLM) باستخدام مكافآت معززة بالسياق للتحقق دقيق التفاصيل، وعينات متعددة الأدوار موجهة بالأخطاء للتخفيف من حدة اختراق المكافأة، مما يمكّن النماذج الأصغر مثل Qwen3-VL-8B من التفوق على النماذج المرجعية الأكبر في مهام الإدراك والاستدلال.

Xingyu Lu, Jinpeng Wang, YiFan Zhang, Shijie Ma, Xiao Hu, Tianke Zhang, Haonan fan, Kaiyu Jiang, Changyi Liu, Kaiyu Tang (…)2026-02-27
💬 NLP

Vectorizing the Trie: Efficient Constrained Decoding for LLM-based Generative Retrieval on Accelerators

تقدم هذه الورقة البحثية STATIC، وهي تقنية فك تشفير مقيدة مبتكرة تعمل على تحويل أشجار البادئات القائمة على هياكل Trie إلى عمليات مصفوفات متفرقة لتمكين استرجاع توليدي عالي الإنتاجية وفعال ومقيد بصرامة على المسرعات العتادية، محققةً تسريعات هائلة وتم نشرها بنجاح على نطاق واسع في نظام إنتاج لتوصية الفيديوهات.

Zhengyang Su, Isay Katsman, Yueqi Wang, Ruining He, Lukasz Heldt, Raghunandan Keshavan, Shao-Chuan Wang, Xinyang Yi, Min (…)2026-02-27
💬 NLP

Enhancing Persuasive Dialogue Agents by Synthesizing Cross-Disciplinary Communication Strategies

تقترح هذه الورقة وتتحقق من صحة إطار عمل مبتكر لوكلاء الحوار الإقناعيين يدمج استراتيجيات عابرة للتخصصات من علم النفس الاجتماعي، والاقتصاد السلوكي، ونظرية الاتصال، مما يظهر تحسناً في معدلات نجاح الإقناع والقدرة على التعميم عبر مجموعات بيانات متنوعة، لا سيما بالنسبة للأفراد ذوي النوايا الأولية المنخفضة.

Shinnosuke Nozue, Yuto Nakano, Yotaro Watanabe, Meguru Takasaki, Shoji Moriya, Reina Akama, Jun Suzuki2026-02-27
💬 NLP

Reinforcing Real-world Service Agents: Balancing Utility and Cost in Task-oriented Dialogue

تقترح هذه الورقة إطار العمل InteractCS-RL، وهو إطار تعلم تعزيزي متعدد المستويات يوازن بين التفاعل التعاطفي مع المستخدم واتخاذ القرارات الواعية بالميزانية في الحوارات الموجهة نحو المهام، وذلك من خلال استخدام بيئة تدريب عالية الدقة متمحورة حول المستخدم واستراتيجية تحسين سياسة واعية بالتكلفة لتحقيق التوازنات المثلى بين مكافآت المستخدم وقيود التكلفة العالمية.

Ning Gao, Wei Zhang, Yuqin Dai, Ling Shi, Ziyin Wang, Yujie Wang, Wei He, Jinpeng Wang, Chaozheng Wang2026-02-27
💬 NLP

Imagination Helps Visual Reasoning, But Not Yet in Latent Space

تتحدى هذه الورقة فعالية الاستدلال البصري الكامن من خلال كشف انفصالاته السببية عن المدخلات والمخرجات، وتقترح CapImagine، وهي طريقة تخيل صريح قائمة على النصوص تتفوق بشكل كبير على النماذج المرجعية المعقدة في الفضاء الكامن.

You Li, Chi Chen, Yanghao Li, Fanhu Zeng, Kaiyu Huang, Jinan Xu, Maosong Sun2026-02-27
💬 NLP

TherapyProbe: Generating Design Knowledge for Relational Safety in Mental Health Chatbots Through Adversarial Simulation

تقدم هذه الورقة TherapyProbe، وهي منهجية محاكاة متعددة الوكلاء وتنافسية ومنخفضة التكلفة، تحدد إخفاقات السلامة العلاقاتية في روبوتات الدردشة الخاصة بالصحة النفسية بمرور الوقت، وتترجمها إلى مكتبة قائمة على أسس سريرية تضم 23 نموذجاً من نماذج الإخفاق مع توصيات تصميمية قابلة للتنفيذ.

Joydeep Chandra, Satyam Kumar Navneet, Yong Zhang2026-02-27
💬 NLP

Probing for Knowledge Attribution in Large Language Models

تقدم هذه الورقة AttriWiki، وهو مسار تعلم ذاتي لتوليد بيانات مصنفة يتيح للمجسات الخطية البسيطة تحديد ما إذا كان مخرج النموذج اللغوي الكبير يعتمد على سياق المطالبة أم على المعرفة الداخلية بدقة، مما يكشف عن وجود رابط قوي بين أخطاء الإسناد والهلوسة مع إظهار قدرة عالية على الانتقال عبر المجالات.

Ivo Brink, Alexander Boer, Dennis Ulmer2026-02-27
💬 NLP

Moral Preferences of LLMs Under Directed Contextual Influence

تقدم هذه الورقة إطار تقييم تجريبي لإثبات أن التأثيرات السياقية الموجهة تعيد تشكيل القرارات الأخلاقية للنماذج اللغوية الكبيرة بشكل كبير في سيناريوهات معضلة العربة، مما يكشف أن الحياد الأساسي هو مؤشر ضعيف لقابلية التوجيه وأن الاستدلال يمكن أن يضخم التحيز بشكل متناقض رغم تقليل الحساسية المتوسطة.

Phil Blandfort, Tushar Karayil, Urja Pawar, Robert Graham, Alex McKenzie, Dmitrii Krasheninnikov2026-02-27