💬 NLP

More Edits, More Stable: Understanding the Lifelong Normalization in Sequential Model Editing

تقدم هذه الورقة أول تفسير نظري لاستقرار "التطبيع مدى الحياة" (Lifelong Normalization) في تحرير النماذج المتسلسل، حيث تثبت دوره في منع النسيان الكارثي وتقدم StableEdit، وهو أسلوب يعزز الاستقرار طويل الأمد من خلال مرحلة إحماء صريحة وتبييض كامل.

Xin Ma, Wei Chen, Qi Liu, Derong Xu, Zhi Zheng, Tong Xu, Enhong Chen2026-05-13
💬 NLP

Probabilistic Calibration Is a Trainable Capability in Language Models

تُثبت هذه الورقة أن المعايرة الاحتمالية هي قدرة قابلة للتدريب في النماذج اللغوية، حيث تُظهر أن الضبط الدقيق على مهام التوزيع الاصطناعي يحسن بشكل كبير دقة أخذ العينات عبر مختلف المعايير، مع تفوق أساليب الأهداف الصلبة في أخذ العينات الرقمية المهيكلة وأداء أساليب الأهداف اللينة بشكل أفضل في مهام التوليد العشوائي الأوسع نطاقاً.

Davide Baldelli, Sruthi Kuriakose, Maryam Hashemzadeh, Amal Zouaq, Sarath Chandar2026-05-13
💬 NLP

Self-Distilled Trajectory-Aware Boltzmann Modeling: Bridging the Training-Inference Discrepancy in Diffusion Language Models

تقدم هذه الورقة البحثية TABOM، وهو إطار عمل للتدريب اللاحق يعتمد على التقطير الذاتي والوعي بالمسار، يعمل على سد الفجوة بين التدريب والاستدلال في نماذج اللغات الانتشارية من خلال نمذجة تفضيلات كشف القناع أثناء الاستدلال كتوزيع بولتزمان لاستخلاص هدف ترتيب زوجي، مما يعزز اكتساب المعرفة ويخفف من النسيان الكارثي مقارنة بالضبط الدقيق القياسي.

Kecheng Chen, Ziru Liu, Xijia Tao, Hui Liu, Yibing Liu, Xinyu Fu, Shi Wu, Suiyun Zhang, Dandan Tu, Lingpeng Kong, Rui Li (…)2026-05-13
💬 NLP

UniVLR: Unifying Text and Vision in Visual Latent Reasoning for Multimodal LLMs

يقدم UniVLR إطار عمل موحداً للاستدلال الكامن البصري للنماذج اللغوية الكبيرة متعددة الوسائط، يقوم بضغط آثار الاستدلال النصي والأدلة البصرية في رموز بصرية مدمجة، مما يتيح استدلالاً فعالاً خالياً من النصوص يتفوق على الأساليب المتداخلة الحالية.

Houcheng Jiang, Jiajun Fu, Junfeng Fang, Chen Gao, Xiang Wang, Xiangnan He, Yong Li2026-05-13
💬 NLP

Concordance Comparison as a Means of Assembling Local Grammars

تقدم هذه الورقة طريقة لتجميع القواعد المحلية من خلال مقارنة توافقاتها لتحديد علاقات الاحتواء والتقاطع والانفصال، والتي طُبقت بنجاح لتحسين التعرف على أسماء الأشخاص البرتغالية في مجموعة بيانات HAREM، محققةً مقياس F قدره 76.86 وزيادة قدرها 6 نقاط عن أحدث ما توصل إليه العلم.

Juliana Pirovani, Elias de Oliveira, Eric Laporte2026-05-13
💬 NLP

On Predicting the Post-training Potential of Pre-trained LLMs

تقدم هذه الورقة البحثية RuDE، وهو إطار تقييم تمييزي قائم على معايير التقييم (rubric) يتنبأ بإمكانات ما بعد التدريب للنماذج اللغوية الكبيرة (LLM) مسبقة التدريب بمعامل ارتباط يتجاوز 90% من خلال تحليل التمييز في الاستجابة بدلاً من التوليد، مما يتيح الاختيار الفعال للنماذج الأصغر ذات الإمكانات العالية.

Xiaoyuan Li, Yubo Ma, Kexin Yang, Moxin Li, Keqin Bao, Wenie Wang, Fuli Feng, Dayiheng Liu2026-05-13
💬 NLP

SkillSafetyBench: Evaluating Agent Safety under Skill-Facing Attack Surfaces

تقدم هذه الورقة البحثية SkillSafetyBench، وهو معيار مرجعي يوضح أن المهارات القابلة لإعادة الاستخدام والقطع البرمجية المحلية يمكن أن تؤدي إلى سلوكيات غير آمنة للوكيل حتى من طلبات المستخدمين الحميدة، مما يكشف أن سلامة الوكيل تعتمد بشكل حاسم على كيفية تفسير النماذج للمهارات وثقتها في سياقات سير العمل بدلاً من مجرد الاعتماد على التوافق على مستوى النموذج.

Chang Jin, An Wang, Zeming Wei, Kai Wang, Biaojie Zeng, Qiaosheng Zhang, Chao Yang, Jingjing Qu, Xia Hu, Xingcheng Xu2026-05-13
💬 NLP

SAGE: Scalable Automated Robustness Augmentation for LLM Knowledge Evaluation

تقترح الورقة البحثية إطار عمل SAGE، وهو إطار عمل قابل للتوسع يستفيد من النماذج الأصغر التي تم ضبطها بدقة مع التعلم المعزز ومُحقِّق قائم على معايير التقييم لتوليد متغيرات قوية ومنخفضة التكلفة لمعايير معرفة النماذج اللغوية الكبيرة تلقائياً، محققاً جودة تضاهي المعايير المُصنفة بشرياً دون الحاجة إلى ضبط دقيق خاص بالمهمة.

Xiaoyuan Li, Yuzhe Wang, Moxin Li, Keqin Bao, Rui Men, Yichang Zhang, Dayiheng Liu, Wenjie Wang, Fuli Feng2026-05-13
💬 NLP

SkillGraph: Skill-Augmented Reinforcement Learning for Agents via Evolving Skill Graphs

تقترح الورقة البحثية إطار عمل SKILLGRAPH، الذي يمثل المهارات كعُقد في رسم بياني موجه ومتطور لتمكين وكلاء النماذج اللغوية الكبيرة من استرجاع رسوم بيانية فرعية للمهارات مرتبة للمهام التركيبية، مما يؤدي إلى تحسين كل من صيانة المكتبة والأداء المتفوق في التعلم المعزز.

Xiaoyuan Li, Moxin Li, Keqin Bao, Yubo Ma, Wenjie Wang, Dayiheng Liu, Fuli Feng2026-05-13