💬 NLP

code_transformed: The Influence of Large Language Models on Code

تقدم هذه الورقة دراسة تجريبية رائدة واسعة النطاق تحلل أكثر من 20,000 مستودع من مستودعات GitHub لتثبت أن النماذج اللغوية الكبيرة تُحدث تحولاً ملموساً في أساليب البرمجة في العالم الحقيقي، وهو ما يتضح من خلال اتجاهات مثل زيادة الالتزام باتفاقيات تسمية snake_case والتحولات في تعقيد الكود وقابلية الصيانة.

Yuliang Xu, Siming Huang, Mingmeng Geng, Yao Wan, Xuanhua Shi, Dongping Chen2026-02-09
💬 NLP

D-SCoRE: Document-Centric Segmentation and CoT Reasoning with Structured Export for QA-CoT Data Generation

يُعد D-SCoRE إطار عمل لا يتطلب تدريباً يقوم تلقائياً بتوليد مجموعات بيانات متنوعة وعالية الجودة لأسئلة وأجوبة قائمة على "سلسلة الأفكار" من مصادر نصية عشوائية، مما يُمكّن النماذج اللغوية الكبيرة التي يتم ضبطها الدقيق بناءً على مخرجاته من التفوق على تلك المدربة على بيانات مشروحة بشرياً مع العمل بكفاءة على أجهزة استهلاكية.

Weibo Zhou, Lingbo Li, Shangsong Liang2026-02-09
💬 NLP

Let LLMs Speak Embedding Languages: Generative Text Embeddings via Iterative Contrastive Refinement

تقدم الورقة البحثية إطار عمل GIRCSE، وهو إطار عمل مبتكر يستفيد من التوليد ذاتي الانحدار وهدف الصقل التبايني التكراري لصقل التمثيلات الدلالية بشكل تكراري، متفوقاً بذلك على تضمينات النماذج اللغوية الكبيرة القائمة على المشفر فقط في الاختبارات المعيارية مع إظهار قدرات ناشئة للتوسع أثناء وقت الاختبار.

Yu-Che Tsai, Kuan-Yu Chen, Yuan-Chi Li, Yuan-Hao Chen, Ching-Yu Tsai, Shou-De Lin2026-02-09
💬 NLP

LeWiDi-2025 at NLPerspectives: Third Edition of the Learning with Disagreements Shared Task

تُعزز النسخة الثالثة من مهمة LeWiDi المشتركة في مؤتمر NLPerspectives تطوير الذكاء الاصطناي المدرك للاختلاف عبر توسيع المعيار المرجعي ليشمل أربع مهام متنوعة في معالجة اللغات الطبيعية ذات مخططات تسمية ترتيبية، وتقديم نماذج تقييم قائمة على التسميات الناعمة والمنظورات مع مقاييس مبتكرة، وتوفير موارد ورؤى جديدة حول نمذجة تباين الأحكام البشرية.

Elisa Leonardelli, Silvia Casola, Siyao Peng, Giulia Rizzi, Valerio Basile, Elisabetta Fersini, Diego Frassinelli, Hyewo (…)2026-02-09
💬 NLP

Personalized Learning Path Planning with Goal-Driven Learner State Modeling

تقدم هذه الورقة البحثية Pxplore، وهو إطار عمل مبتكر يجمع بين التعلم المعزز والنماذج اللغوية الكبيرة لتوليد مسارات تعلم شخصية وموجهة نحو الأهداف من خلال نمذجة حالات المتعلمين وتحسين السياسات عبر الضبط الدقيق الخاضع للإشراف وتحسين السياسة النسبي للمجموعات.

Joy Jia Yin Lim, Ye He, Jifan Yu, Xin Cong, Daniel Zhang-Li, Zhiyuan Liu, Huiqin Liu, Lei Hou, Juanzi Li, Bin Xu2026-02-09
💬 NLP

Quantifying the Effect of Test Set Contamination on Generative Evaluations

تُثبت هذه الورقة كمياً أن تلوث مجموعة الاختبار يؤدي إلى تضخيم أداء التقييم التوليدي بشكل كبير من خلال تمكين النماذج من تجاوز الخطأ غير القابل للاختزال عبر الحفظ، بينما تكشف أن عوامل مثل حجم النموذج، ومدة التدريب، ودرجة حرارة الاستدلال تعدل هذه التأثيرات بشكل حاسم بطرق تختلف عن التقييمات التمييزية.

Rylan Schaeffer, Joshua Kazdan, Baber Abbasi, Ken Ziyu Liu, Brando Miranda, Ahmed Ahmed, Fazl Berez, Abhay Puri, Stella (…)2026-02-09
💬 NLP

Think-Augmented Function Calling: Improving LLM Parameter Accuracy Through Embedded Reasoning

تقترح هذه الورقة إطار عمل "استدعاء الوظائف المعزز بالتفكير" (TAFC)، وهو إطار عمل مبتكر يعزز دقة وقابلية تفسير استدعاء الوظائف في النماذج اللغوية الكبيرة (LLMs) من خلال تضمين استدلال صريح وديناميكي مباشرة في توليد المعلمات دون الحاجة إلى تعديلات هيكلية.

Lei Wei, Xiao Peng, Jinpeng Ou, Bin Wang2026-02-09
💬 NLP

FadeMem: Biologically-Inspired Forgetting for Efficient Agent Memory

تقدم الورقة البحثية FadeMem، وهي بنية ذاكرة لوكيل مستوحاة بيولوجياً تستخدم التحلل الأسي التكيفي وتسلسلاً هرمياً ثنائي الطبقات لنسيان المعلومات غير ذات الصلة بشكل انتقائي، مما يحقق أداءً فائقاً في الاستدلال متعدد الخطوات والاسترجاع مع تقليل بنسبة 45% في التخزين مقارنة باستراتيجيات الاحتفاظ الثنائية التقليدية.

Lei Wei, Xiao Peng, Xu Dong, Niantao Xie, Bin Wang2026-02-09
💬 NLP

DimStance: Multilingual Datasets for Dimensional Stance Analysis

تقدم الورقة البحثية DimStance، وهي أول مجموعة بيانات متعددة اللغات تتضمن تعليقات توضيحية للقيمة (valence) والاستثارة (arousal) لـ 7,365 نصاً عبر خمس لغات، لتمكين تحليل الموقف البعدي دقيق التفاصيل واختبار أداء نماذج مختلفة في التنبؤ بهذه الحالات الوجدانية.

Jonas Becker, Liang-Chih Yu, Shamsuddeen Hassan Muhammad, Jan Philip Wahle, Terry Ruas, Idris Abdulmumin, Lung-Hao Lee (…)2026-02-09
💬 NLP

MAGIC: A Co-Evolving Attacker-Defender Adversarial Game for Robust LLM Safety

تقدم هذه الورقة إطار عمل MAGIC، وهو إطار عمل جديد للتعلم المعزز متعدد الوكلاء ومتعدد الجولات يعزز سلامة النماذج اللغوية الكبيرة من خلال لعبة تنافسية مشتركة التطور، حيث يقوم وكيل مهاجم بتوليد استراتيجيات تركيبية مبتكرة ديناميكيًا لكشف الثغرات، مما يدفع وكيل مدافع إلى التعميم والرفض القوي للمدخلات التنافسية غير المرئية.

Xiaoyu Wen, Zhida He, Han Qi, Ziyu Wan, Zhongtian Ma, Ying Wen, Tianhang Zheng, Xingcheng Xu, Chaochao Lu, Qiaosheng Zha (…)2026-02-09