💬 NLP

Why Tree-Style Branching Matters for Thought Advantage Estimation in GRPO

تُثبت هذه الورقة نظرياً وتجريبياً أنه في خوارزمية GRPO، يُعد زيادة عدد الإجابات التي يتم أخذ عينات منها لكل فكرة (التفرع) آلية ضرورية للقضاء على التباين في تقدير الميزة على مستوى الفكرة، بينما لا يمكن لمجرد زيادة عدد الأفكما التي يتم أخذ عينات منها أن يحقق ذلك، مما يثبت أن التفرع أمر أساسي لتحسين الاستدلال بشكل مستقر وفعال.

Hongcheng Wang, Yinuo Huang, Sukai Wang, Guanghui Ren, Hao Dong2026-02-06
💬 NLP

Pattern Enhanced Multi-Turn Jailbreaking: Exploiting Structural Vulnerabilities in Large Language Models

تقدم هذه الورقة البحثية "سلسلة الهجوم المعززة بالأنماط" (PE-CoA)، وهو إطار عمل يستخدم خمسة أنماط محادثة متميزة لاستغلال الثغرات الهيكلية في النماذج اللغوية الكبيرة بشكل منهجي، مما يكشف أن الدفاعات الأمنية خاصة بكل نمط ولا تتعمم عبر فئات الضرر المختلفة.

Ragib Amin Nihal, Rui Wen, Kazuhiro Nakadai, Jun Sakuma2026-02-06
💬 NLP

Fine-tuned LLM-based Code Migration Framework

تقدم هذه الورقة إطار عمل لنماذج لغوية كبيرة مضبوطة بدقة تعمل بفعالية على أتمتة هجرة الأنظمة القائمة على لغة SQL من Oracle PL/SQL إلى PostgreSQL عبر دمج تقنيات الهندسة التقليدية، وتحليل الأخطاء التكراري، وملاحظات الخبراء لتقليل الأخطاء النحوية بشكل كبير وتحسين منطق قواعد البيانات.

Oleg Grynets, Vasyl Lyashkevych, Dmytro Baran, Maksym Orliansky, Taras Zelenyy, Markiian Leshchyshyn2026-02-06
💬 NLP

Improving Diffusion Language Model Decoding through Joint Search in Generation Order and Token Space

تقدم هذه الورقة البحثية "البحث عن ترتيب الرموز" (Order-Token Search)، وهي طريقة فك تشفير مبتكرة لنماذج اللغة الانتشارية تستكشف بشكل مشترك ترتيب التوليد وفضاء الرموز لتتفوق على النماذج المرجعية الحالية في معايير الاستدلال الرياضي والبرمجة.

Yangyi Shen, Tianjian Feng, Jiaqi Han, Wen Wang, Tianlang Chen, Chunhua Shen, Jure Leskovec, Stefano Ermon2026-02-06
💬 NLP

From Latent Signals to Reflection Behavior: Tracing Meta-Cognitive Activation Trajectory in R1-Style LLMs

توضح هذه الورقة الآليات الداخلية للنماذج اللغوية الكبيرة من طراز R1 عبر تتبع مسار معرفي وراءي سببي مكون من ثلاث مراحل — من مراقبة الميزانية الكامنة إلى تنظيم الإشارات على مستوى الخطاب وصولاً إلى التأمل الذاتي الصريح — باستخدام تحليل عدسة اللوجيت (logit lens) والتدخلات المستهدفة للكشف عن كيفية دفع دلالات المطالبة لسلوك التأمل.

Yanrui Du, Yibo Gao, Sendong Zhao, Jiayun Li, Haochun Wang, Qika Lin, Kai He, Bing Qin, Mengling Feng2026-02-06
💬 NLP

Training Data Efficiency in Multimodal Process Reward Models

تتناول هذه الورقة تكاليف التدريب المرتفعة لنماذج مكافأة العمليات متعددة الوسائط من خلال تقديم إطار نظري وطريقة "درجة المعلومات المتوازنة" (BIS)، التي تستفيد من إشارات التدفق الحالية لاختيار مجموعات فرعية من البيانات عالية المعلومات تحقق أداء كامل البيانات باستخدام 10% فقط من مجموعة بيانات التدريب.

Jinyuan Li, Chengsong Huang, Langlin Huang, Shaoyang Xu, Haolin Liu, Wenxuan Zhang, Jiaxin Huang2026-02-06
💬 NLP

Atomic Information Flow: A Network Flow Model for Tool Attributions in RAG Systems

تقدم هذه الورقة البحثية "تدفق المعلومات الذري" (AIF)، وهو نموذج تدفق شبكي قائم على الرسوم البيانية يعمل على تفكيك مخرجات أنظمة التوليد المعزز بالاسترجاع (RAG) إلى وحدات معلومات غير قابلة للتجزئة لتمكين الإسناد الدقيق للأدوات، والذي يُستخدم بعد ذلك لتدريب نموذج لغوي خفيف الوزن بحجم 4 مليارات معلمة لتحقيق دقة بنسبة 82.71% في تحديد المعلومات الحرجة وضغط سياق بنسبة 87.52%، مما يسد بفعالية فجوة الأداء مع نموذج أكبر بكثير بحجم 27 مليار معلمة.

James Gao, Josh Zhou, Qi Sun, Ryan Huang, Steven Yoo2026-02-06
💬 NLP

Pruning Minimal Reasoning Graphs for Efficient Retrieval-Augmented Generation

تقدم الورقة البحثية AutoPrunedRetriever، وهو نظام استرجاع مدعوم بالتوليد (RAG) قائم على الرسوم البيانية يقوم بتخزين وتحديث رسم بياني فرعي للاستدلال الأدنى بشكل تراكمي باستخدام دفتر رموز مدمج وسياسات تقليم، محققاً دقة هي الأفضل في فئتها على معايير الاستدلال المعقدة مع تقليل استهلاك الرموز (tokens) بشكل كبير مقارنة بالنهج التقليدية.

Ning Wang, Kuanyan Zhu, Daniel Yuehwoon Yee, Yitang Gao, Shiying Huang, Zirun Xu, Sainyam Galhotra2026-02-06
💬 NLP

Capacity Constraints and the Multilingual Penalty for Lexical Disambiguation

تُثبت هذه الورقة أن النماذج اللغوية متعددة اللغات تُظهر أداءً أدنى من نظيراتها أحادية اللغة في عملية إزالة اللبس المعجمي بسبب قيود سعة محددة — وهي تضاؤل تماثل التضمين، وانخفاض الانتباه إلى الإشارات الموضحة للبس، وزيادة تجزئة الرموز المتعددة — والتي تفسر مجتمعةً "العقوبة متعددة اللغات" الملحوظة.

Sean Trott, Pamela D. Rivière2026-02-06
💬 NLP

VEXA: Evidence-Grounded and Persona-Adaptive Explanations for Scam Risk Sensemaking

تقترح الورقة البحثية إطار عمل VEXA، الذي يولد تفسيرات موثوقة لعمليات الاحتيال موجهة للمتعلمين من خلال دمج تأصيل الأدلة القائم على GradientSHAP مع التكيف مع الشخصيات المستند إلى النظرية لضمان الموثوقية الدلالية والقابلية للتفسير الأسلوبي دون المساس بالأمانة.

Heajun An, Connor Ng, Sandesh Sharma Dulal, Junghwan Kim, Jin-Hee Cho2026-02-06