💬 NLP

Generative Prompt Internalization

تقترح هذه الورقة البحثية طريقة "الاستيعاب الداخلي للمطالبات التوليدية" (GenPI)، وهي طريقة تدريب مشترك خفيفة الوزن تُمكّن النماذج اللغوية الكبيرة من توليد واستيعمال المطالبات المعقدة وما يكمن وراءها من منطق بشكل ذاتي، مما يحقق أداءً عالياً واستدلالاً فعالاً دون العبء الحسابي للمطالبات الطويلة الصريحة.

Haebin Shin, Lei Ji, Yeyun Gong, Sungdong Kim, Eunbi Choi, Minjoon Seo2026-02-12
💬 NLP

SCALE: Towards Collaborative Content Analysis in Social Science with Large Language Model Agents and Human Intervention

تقدم هذه الورقة SCALE، وهو إطار عمل جديد متعدد الوكلاء يحاكي تحليل محتوى العلوم الاجتماعية التعاوني من خلال الجمع بين وكلاء النماذج اللغوية الكبيرة والتدخل البشري لتحقيق أداء يقارب الأداء البشري في ترميز النصوص، والمناقشة، وتطور دليل الرموز الديناميكي.

Chengshuai Zhao, Zhen Tan, Chau-Wai Wong, Xinyan Zhao, Tianlong Chen, Huan Liu2026-02-12
💬 NLP

ZeroTuning: Unlocking the Initial Token's Power to Enhance Large Language Models Without Training

تُعد ZeroTuning طريقةً لا تعتمد على التدريب ولا ترتبط بنواة محددة، تعمل على تعزيز النماذج اللغوية الكبيرة المجمدة من خلال تطبيق تعديلات خفيفة الوزن على الانتباه الخاص بالرؤوس للرمز الأول، متفوقةً بذلك على طرق التدخل على مستوى الرمز الحالية عبر مهام متنوعة.

Feijiang Han, Xiaodong Yu, Jianheng Tang, Delip Rao, Weihua Du, Lyle Ungar2026-02-12
💬 NLP

Intrinsic Self-Correction in LLMs: Towards Explainable Prompting via Mechanistic Interpretability

تُثبت هذه الورقة أن التصحيح الذاتي الجوهري في النماذج اللغوية الكبيرة مدفوع بتوجيه التمثيلات الخفية على طول اتجاهات كامنة قابلة للتفسير، وهي آلية تم التحقق من صحتها من خلال تحليل المحاذاة وتدخلات التنشيط السببية.

Yu-Ting Lee, Fu-Chieh Chang, Yu-En Shu, Hui-Ying Shih, Pei-Yuan Wu2026-02-12
💬 NLP

WAVE++: Capturing Within-Task Variance for Continual Relation Extraction with Adaptive Prompting

تُعد WAVE++ نهجاً جديداً قائماً على المطالبات لاستخراج العلاقات المستمر، حيث تعمل على التخفيف من النسيان الكارثي والتعامل مع تغيرات المهام من خلال استخدام مجموعات مطالبات خاصة بكل مهمة، وأوصاف للتسميات، ونموذج توليدي لدمج المعرفة دون الحاجة إلى تخزين البيانات بشكل صريح.

Bao-Ngoc Dao, Minh Le, Quang Nguyen, Luyen Ngo Dinh, Nam Le, Linh Ngo Van2026-02-12
💬 NLP

Attributing Response to Context: A Jensen-Shannon Divergence Driven Mechanistic Study of Context Attribution in Retrieval-Augmented Generation

تقدم هذه الورقة البحثية ARC-JSD، وهي طريقة فعالة حاسبياً تستخدم تباعد جينسن-شانونون (Jensen-Shannon Divergence) لنسب الاستجابات المولدة بدقة إلى أجزاء سياقية محددة في أنظمة التوليد المعزز بالاسترجاع (RAG) دون الحاجة إلى ضبط دقيق، مع توفير رؤى ميكانيكية حول رؤوس الانتباه وطبقات MLP المحددة المسؤولة عن هذا النسب.

Ruizhe Li, Chen Chen, Yuchen Hu, Yanjun Gao, Xi Wang, Emine Yilmaz2026-02-12
💬 NLP

Is Your LLM Really Mastering the Concept? A Multi-Agent Benchmark

تقدم الورقة البحثية CK-Arena، وهو معيار اختبار ديناميكي متعدد الوكلاء يعتمد على لعبة الاستنتاج الاجتماعي "Undercover"، والمصمم لتقييم ما إذا كانت النماذج اللغوية الكبيرة تتقن حقاً البنى المفاهيمية أم أنها تعتمد مجرد اعتماد على حفظ الأنماط السطحية.

Shuhang Xu, Weijian Deng, Yixuan Zhou, Fangwei Zhong2026-02-12
💬 NLP

Unveiling the "Fairness Seesaw": Discovering and Mitigating Gender and Race Bias in Vision-Language Models

تتقصى هذه الورقة بشكل منهجي التحيز القائم على النوع الاجتماعي والعرق في نماذج الرؤية واللغة من خلال تحليل الحالات الخفية الداخلية وتوزيعات الاحتمالات، مكتشفةً أن التحيز غالباً ما يستمر في درجات الثقة وفي مسارات متبقية محددة، وتقترح إطار عمل لاحقاً يسمى RES-FAIR للتخفيف من حدة هذه التحيزات عن طريق إعادة معايرة ديناميكيات الحالة الخفية.

Jian Lan, Udo Schlegel, Tanveer Hannan, Gengyuan Zhang, Haokun Chen, Thomas Seidl2026-02-12
💬 NLP

Cross-Attention Speculative Decoding

تقدم الورقة البحثية نموذج Budget EAGLE (Beagle)، وهو بنية لفك التشفير الاستنتاجي تعتمد على الانتباه المتقاطع (cross-attention) بشكل مبسط، وتحقق أداءً يضاهي نماذج الانتباه الذاتي (self-attention) الحديثة مع توفير كفاءة تدريب محسنة وبساطة هيكلية من خلال طريقة تدريب مبتكرة تعتمد على "انتباه الكتلة ذات المرحلتين" (Two-Stage Block-Attention Training).

Wei Zhong, Manasa Bharadwaj, Yixiao Wang, Yipeng Ji, Chul Lee2026-02-12
💬 NLP

Towards Efficient Speech-Text Jointly Decoding within One Speech Language Model

تقارن هذه الورقة البحثية بشكل منهجي بين نماذج فك التشفير المشترك بين الكلام والنص، وتقترح نمط "التوقف المبكر المتداخل" (ESI) الجديد لتسريع سرعة الاستدلال بشكل كبير مع الحفاظ على الأداء أو تحسينه في نماذج اللغة الكلامية.

Haibin Wu, Yuxuan Hu, Ruchao Fan, Xiaofei Wang, Kenichi Kumatani, Bo Ren, Jianwei Yu, Heng Lu, Lijuan Wang, Yao Qian, Ji (…)2026-02-12