💬 NLP

How Do Decoder-Only LLMs Perceive Users? Rethinking Attention Masking for User Representation Learning

تتقصى هذه الورقة كيفية تأثير استراتيجيات قناع الانتباه المختلفة على جودة تضمينات المستخدم في النماذج اللغوية الكبيرة ذات فك التشفير فقط، وتقترح "القناع الناعم الموجه بالتدرج" لتسهيل الانتقال المستقر من الانتباه السببي إلى الانتباه ثنائي الاتجاه أثناء تعلم تمثيل المستخدم.

Jiahao Yuan, Yike Xu, Jinyong Wen, Baokun Wang, Yang Chen, Xiaotong Lin, Wuliang Huang, Ziyi Gao, Xing Fu, Yu Cheng, Wei (…)2026-02-12
💬 NLP

UMEM: Unified Memory Extraction and Management Framework for Generalizable Memory

إن UMEM هو إطار عمل لوكيل ذاتي التطور يعمل على تحسين تعميم الذاكرة من خلال التحسين المشترك لاستخراج الذاكرة وإدارتها عبر نمذجة الجوار الدلالي ومكافآت المنفعة الهامشية على مستوى الجوار عبر GRPO.

Yongshi Ye, Hui Jiang, Feihu Jiang, Tian Lan, Yichao Du, Biao Fu, Xiaodong Shi, Qianghuai Jia, Longyue Wang, Weihua Luo2026-02-12
💬 NLP

Benchmarks Are Not That Out of Distribution: Word Overlap Predicts Performance

تُظهر الورقة البحثية أن أداء المعايير المرجعية يتنبأ به بقوة التداخل الإحصائي على مستوى الكلمات بين بيانات ما قبل التدريب ومجموعات التقييم، مما يشير إلى أن العديد من المعايير المرجعية القياسية ليست بعيدة عن التوزيع بشكل ملحوظ عن المتون المستخدمة في التدريب.

Woojin Chung, Jeonghoon Kim2026-02-12
💬 NLP

Calliope: A TTS-based Narrated E-book Creator Ensuring Exact Synchronization, Privacy, and Layout Fidelity

كاليوبي (Calliope) هو إطار عمل مفتوح المصدر يحول الكتب الإلكترونية النصية إلى كتب إلكترونية بصيغة EPUB 3 مسموعة عبر الاستفضاء من تقنيات تحويل النص إلى كلام (TTS) الحديثة لضمان المزامنة الدقيقة بين الصوت والنص، ودقة التنسيق، والخصوصية الكاملة دون اتصال بالإنترنت.

Hugo L. Hammer, Vajira Thambawita, Pål Halvorsen2026-02-12
💬 NLP

Reinforced Curriculum Pre-Alignment for Domain-Adaptive VLMs

تقترح الورقة البحثية "المحاذاة المسبقة المنهجية المعززة" (RCPA)، وهي نموذج تدريب لاحق مبتكر يستخدم آلية تعديل تدريجي واعية بالمنهج لتكييف نماذج الرؤية واللغة مع المجالات المتخصصة مع منع النسيان الكارثي وانهيار الأمثلة.

Yuming Yan, Shuo Yang, Kai Tang, Sihong Chen, Yang Zhang, Ke Xu, Dan Hu, Qun Yu, Pengfei Hu, Edith C. H. Ngai2026-02-12
💬 NLP

Beyond Confidence: The Rhythms of Reasoning in Generative Models

تقدم الورقة البحثية حد قيد الرمز (δTCB\delta_{\mathrm{TCB}})، وهو مقياس مبتكر يحدد كمياً استقرار الالتزام التنبؤي الداخلي للنماذج اللغوية الكبيرة من خلال قياس مقدار الاضطراب في المدخلات الذي يمكن للنموذج تحمله قبل أن يتغير تنبؤ الرمز الأعلى لديه، مما يوفر طريقة أكثر قوة لتقييم الموثوقية السياقية مقارنة بالمقاييس التقليدية مثل الحيرة (perplexity).

Deyuan Liu, Zecheng Wang, Zhanyue Qin, Zhiying Tu, Dianhui Chu, Dianbo Sui2026-02-12
💬 NLP

Diagnosing Structural Failures in LLM-Based Evidence Extraction for Meta-Analysis

تقدم هذه الورقة إطاراً تشخيصياً لإثبات أنه في حين تستطيع النماذج اللغوية الكبيرة أداء استخراج الكيانات الأساسية، إلا أنها تخفق بشكل كبير في الربط العلاقاتي المعقد والتأصيل العددي المطلوب للتحليل التلوي، مما يؤدي إلى أخطاء هيكلية منهجية تجعل استخراج الأدلة المؤتمت غير موثوق.

Zhiyin Tan, Jennifer D'Souza2026-02-12
💬 NLP

The CLEF-2026 FinMMEval Lab: Multilingual and Multimodal Evaluation of Financial AI Systems

يقدم مختبر CLEF-2026 FinMMEval أول إطار تقييم متعدد اللغات والوسائط لنماذج اللغة الكبيرة المالية من خلال ثلاث مهام مترابطة مصممة لتقييم قدرات الاستنتاج، والإجابة على الأسئلة، واتخاذ القرار عبر لغات وتنسيقات متنوعة.

Zhuohan Xie, Rania Elbadry, Fan Zhang, Georgi Georgiev, Xueqing Peng, Lingfei Qian, Jimin Huang, Dimitar Dimitrov, Vansh (…)2026-02-12
💬 NLP

Rotary Positional Embeddings as Phase Modulation: Theoretical Bounds on the RoPE Base for Long-Context Transformers

تعيد هذه الورقة تفسير تضمينات الموضع الدوارة (RoPE) بوصفها تعديلاً للطور لاستخلاص حدود دنيا وعليا نظرية لمعلم المعامل الأساسي لـ RoPE، مما يؤسس "منطقة غولديلوكس" من الدقة والعمق التي تحدد جدوى نمذجة السياق الطويل.

Feilong Liu2026-02-12
💬 NLP

Can Large Language Models Make Everyone Happy?

تقدم الورقة البحثية **MisAlign-Profile**، وهو معيار موحد يتضمن مجموعة بيانات **MISALIGNTRADE**، المصمم لقياس وتوصيف المقايضات المعقدة بين أبعاد السلامة والقيمة والثقافة في النماذج اللغوية الكبيرة بشكل منهجي.

Usman Naseem, Gautam Siddharth Kashyap, Ebad Shabbir, Sushant Kumar Ray, Abdullah Mohammad, Rafiq Ali2026-02-12