💬 NLP

Test-time Recursive Thinking: Self-Improvement without External Feedback

تقترح الورقة البحثية "التفكير العودي في وقت الاختبار" (TRT)، وهو إطار عمل للتحسين الذاتي التكراري يُمكّن النماذج اللغوية الكبيرة من تعزيز أدائها في الاستنتاج والبرمجة بشكل كبير في الاختبارات المعيارية الصعبة دون الحاجة إلى تغذية راجعة خارجية أو تدريب إضافي، وذلك عبر الاستفادة من توليد مرشحات متنوعة والتحقق الذاتي.

Yufan Zhuang, Chandan Singh, Liyuan Liu, Yelong Shen, Dinghuai Zhang, Jingbo Shang, Jianfeng Gao, Weizhu Chen2026-02-04
💬 NLP

ForesightKV: Optimizing KV Cache Eviction for Reasoning Models by Learning Long-Term Contribution

يُعد ForesightKV إطار عمل قائمًا على التدريب يعمل على تحسين عملية استبعاد ذاكرة التخزين المؤقت لـ KV لنماذج الاستنتاج من خلال الجمع بين خوارزمية "الاستبعاد الذهبي" (Golden Eviction) والتعلم الخاضع للإشراف والتعلم المعزز (GRPO) للتنبؤ بأزواج KV الأكثر أهمية والاحتفاظ بها، مما يقلل بشكل كبير من تكاليف الذاكرة مع الحفاظ على أداء عالٍ في مهام الاستنتاج الطويلة.

Zican Dong, Peiyu Liu, Junyi Li, Zhipeng Chen, Han Peng, Shuo Wang, Wayne Xin Zhao2026-02-04
💬 NLP

ATACompressor: Adaptive Task-Aware Compression for Efficient Long-Context Processing in LLMs

تقدم الورقة البحثية ATACompressor، وهي طريقة ضغط تكيفية مدركة للمهام تقوم باختيار وضغط الأجزاء ذات الصلة بالمهمة فقط من السياقات الطويلة ديناميكيًا للتخفيف من مشكلة "الضياع في المنتصف"، وبذلك تتفوق على الأساليب الحالية في كل من كفاءة الضغط وأداء المهام في اختبارات قياس الأسئلة والأجوبة.

Xuancheng Li, Haitao Li, Yujia Zhou, Qingyao Ai, Yiqun Liu2026-02-04
💬 NLP

Accurate Failure Prediction in Agents Does Not Imply Effective Failure Prevention

توضح هذه الورقة أن الدقة العالية في العمليات غير المتصلة بالإنترنت لنماذج النقد القائمة على النماذج اللغوية الكبيرة لا تضمن منع الفشل بفعالية أثناء النشر بسبب مقايضة الاضطراب والاسترداد، وتقترح اختباراً تجريبياً خفيف الوزن قبل النشر لتحديد الحالات التي قد تؤدي فيها التدخلات إلى تدهور حاد في الأداء بدلاً من التحسين.

Rakshith Vasudev, Melisa Russak, Dan Bikel, Waseem Alshikh2026-02-04
💬 NLP

GFlowPO: Generative Flow Network as a Language Model Prompt Optimizer

تُعد GFlowPO إطار عمل لتحسين الأوامر النصية يتميز بكفاءة العينة، حيث يجمع بين شبكة تدفق توليدية خارج السياسة لضبط نموذج لغوي للأوامر النصية وبين آلية تحديث ذاكرة ديناميكية خالية من التدريب لتركيز البحث تدريجياً على الأوامر النصية ذات المكافأة العالية، متفوقاً بذلك على النماذج المرجعية للتحسين المنفصل الموجودة عبر مهام متنوعة.

Junmo Cho, Suhan Kim, Sangjune An, Minsu Kim, Dong Bok Lee, Heejun Lee, Sung Ju Hwang, Hae Beom Lee2026-02-04
💬 NLP

A-RAG: Scaling Agentic Retrieval-Augmented Generation via Hierarchical Retrieval Interfaces

تقدم هذه الورقة البحثية A-RAG، وهو إطار عمل للـ RAG الوكيل (agentic RAG) الذي يتيح واجهات استرجاع هرمية (البحث بالكلمات المفتاحية، والبحث الدلالي، وقراءة القطع) مباشرة للنماذج اللغوية، مما يسمح باسترجاع معلومات تكيفي ومتعدد المستويات يتفوق باستمرار على النماذج الحالية مع التوسع بفعالية مع حجم النموذج وحوسبة وقت الاختبار.

Mingxuan Du, Benfeng Xu, Chiwei Zhu, Shaohan Wang, Pengyu Wang, Xiaorui Wang, Zhendong Mao2026-02-04
💬 NLP

Self-Verification Dilemma: Experience-Driven Suppression of Overused Checking in LLM Reasoning

تحدد هذه الورقة أن نماذج الاستدلال الكبيرة تنخرط تكراراً في خطوات تحقق ذاتي غير منتجة، وتقترح إطار عمل وقت الاختبار مدفوعاً بالخبرة يستفيد من النتائج التاريخية لكبح عمليات التحقق الزائدة هذه، مما يقلل بشكل كبير من استهلاك الرموز (tokens) مع الحفاظ على الدقة أو تحسينها.

Quanyu Long, Kai Jie Jiang, Jianda Chen, Xu Guo, Leilei Gan, Wenya Wang2026-02-04
💬 NLP

Assessing the Impact of Typological Features on Multilingual Machine Translation in the Age of Large Language Models

تُظهر هذه الورقة أن السمات النمطية للغة الهدف تؤثر بشكل كبير على جودة الترجمة في النماذج اللغوية الكبيرة متعددة اللغات والمتطورة مثل NLLB-200 وTower+، حتى بعد ضبط توافر البيانات والخط، كما تقترح أيضًا أن اللغات ذات الخصائص النمطية المحددة يمكن أن تستفيد من استراتيجيات فك ترميز بديلة.

Vitalii Hirak, Jaap Jumelet, Arianna Bisazza2026-02-04
💬 NLP

Efficient Algorithms for Partial Constraint Satisfaction Problems over Control-flow Graphs

تقدم هذه الورقة خوارزمية عامة ذات زمن خطي لحل مشكلات الالتزام الجزئي (Partial Constraint Satisfaction Problems) عبر رسوم بيانية لتدفق التحكم مفككة إلى هياكل تسلسلية-متوازية-حلقية (Series-Parallel-Loop) مع نطاق ثابت، مما يوحد النهج السابقة لمهام مثل تخصيص السجلات ويحقق تحسينات كبيرة في الأداء في الاختيار الأمثل للبنوك.

Xuran Cai, Amir Goharshady2026-02-04
💬 NLP

Controlling Output Rankings in Generative Engines for LLM-based Search

تقدم هذه الورقة CORE، وهي طريقة تحسين تقوم بإلحاق المحتوى استراتيجياً بنتائج محركات البحث للتلاعب بترتيب المخرجات لمحركات التوليد القائمة على النماذج اللغوية الكبيرة، مما يحقق معدلات نجاح ترويجية عالية للمنتجات المستهدفة عبر نماذج وفئات متعددة مع الحفاظ على سلاسة المحتوى.

Haibo Jin, Ruoxi Chen, Peiyan Zhang, Yifeng Luo, Huimin Zeng, Man Luo, Haohan Wang2026-02-04