💬 NLP

Recent Advancements and Challenges of Turkic Central Asian Language Processing

تستعرض هذه الورقة الحالة الراهنة لمعالجة اللغات الطبيعية للغات التركية في آسيا الوسطى (الكازاخية، والأوزبكية، والقيرغيزية، والتركمانية)، مع تسليط الضوء على التقدم الأخير في جمع مجموعات البيانات وتطوير النماذج، مع معالجة تحديات ندرة الموارد المستمرة وتحديد اتجاهات البحث المستقبلية.

Yana Veitsman, Mareike Hartmann2026-02-17
💬 NLP

Cautious Optimizers: Improving Training with One Line of Code

تقدم هذه الورقة البحثية "المُحسِّنات الحذرة" (Cautious Optimizers)، وهي تعديل من سطر واحد على المُحسِّنات القائمة على الزخم مثل AdamW، يحافظ على ضمانات التقارب النظرية مع تقديم تسريع متسق في تدريب النماذج اللغوية الكبيرة وتصنيف الصور مع حد أدنى من ضبط المعلمات الفائقة.

Kaizhao Liang, Lizhang Chen, Bo Liu, Qiang Liu2026-02-17
💬 NLP

Is it the end of (generative) linguistics as we know it?

تجادل هذه الورقة بأن اللسانيات التوليدية يجب أن تخضع لتحديث صارم يتضمن صياغات رسمية أكثر دقة ومجموعات بيانات تجريبية معيارية لمعالجة التحديات الحرجة لفرضية "فقر المثير" وبساطة "البرنامج الأدنى"، وذلك لاستعادة دورها المركزي في الدراسات اللغوية مع الإقرار بضرورة المنظورات الرسمية لكل من المقاربات الحوسبية والتجريبية.

Cristiano Chesi2026-02-17
💬 NLP

FastKV: Decoupling of Context Reduction and KV Cache Compression for Prefill-Decoding Acceleration

يُعد FastKV إطار عمل مبتكر لضغط ذاكرة التخزين المؤقت من نوع (KV cache) يعمل على فصل تقليل حسابات مرحلة الـ (prefill) عن ميزانية الـ (KV) لمرحلة الـ (decoding) عبر الاستفادة من استقرار أهمية الرموز (token importance) في الطبقات المتأخرة، مما يحقق تسريعاً كبيراً في كلتا مرحلتي الـ (prefill) والـ (decoding) دون التضحية بالدقة.

Dongwon Jo, Jiwon Song, Yulhwa Kim, Jae-Joon Kim2026-02-17
💬 NLP

HIPPO: Enhancing the Table Understanding Capability of LLMs through Hybrid-Modal Preference Optimization

تقدم هذه الورقة البحثية HIPPO، وهو إطار عمل هجين لتحسين التفضيلات يعزز قدرات فهم واستنتاج الجداول في النماذج اللغوية الكبيرة متعددة الوسائط من خلال الاستفادة المشتركة من التمثيلات النصية والصورية عبر استراتيجية أخذ عينات متسقة مع الوسائط، محققاً تحسينات ملحوظة في الأداء في المهام المتعلقة بالجداول.

Haolan Wang, Zhenghao Liu, Xinze Li, Xiaocui Yang, Yu Gu, Yukun Yan, Qi Shi, Fangfang Li, Chong Chen, Ge Yu2026-02-17
💬 NLP

Benchmarking Retrieval-Augmented Generation for Chemistry

تقدم هذه الورقة ChemRAG-Bench، وهو معيار شامل ومجموعة أدوات مصاحبة مصممة لتقييم وتحسين أنظمة التوليد المعزز بالاسترجاع في مجال الكيمياء، مما يظهر تحسينات كبيرة في الأداء مقارنة بطرق الاستدلال المباشر من خلال التحليل المنهجي لاستراتيجيات الاسترجاع واختيار المتون.

Xianrui Zhong, Bowen Jin, Siru Ouyang, Yanzhen Shen, Qiao Jin, Yin Fang, Zhiyong Lu, Jiawei Han2026-02-17
💬 NLP

Scalable LLM Reasoning Acceleration with Low-rank Distillation

تقدم الورقة البحثية Caprese، وهي طريقة تقطير فعالة في استهلاك الموارد تستخدم مجموعة صغيرة من العينات الاصطناعية والحد الأدنى من المعلمات الإضافية لاستعادة قدرات الاستدلال الرياضي للنماذج اللغوية الكبيرة التي تضررت بسبب تقنيات الاستنتاج الفعالة، مع تقليل عدد المعلمات النشطة، وزمن الاستجابة، وعدد الرموز (tokens) في الوقت ذاته دون تدهور الأداء اللغوي.

Harry Dong, Bilge Acun, Beidi Chen, Yuejie Chi2026-02-17
💬 NLP

EVALOOOP: A Self-Consistency-Centered Framework for Assessing Large Language Model Robustness in Programming

تقدم هذه الورقة EVALOOOP، وهو إطار عمل مبتكر يقيم متانة النماذج اللغوية الكبيرة في البرمجة من خلال قياس متوسط الحلقات المستدامة (ASL) لتحويلات الكود الوظيفي إلى اللغة الطبيعية، مما يكشف أن النماذج ذات الأداء الأولي المتفوق لا تظهر بالضرورة استقراراً جوهرياً أكبر تحت المهام التكرارية ذات المرجعية الذاتية.

Sen Fang, Weiyuan Ding, Mengshi Zhang, Zihao Chen, Bowen Xu2026-02-17
💬 NLP

RAVENEA: A Benchmark for Multimodal Retrieval-Augmented Visual Culture Understanding

تقدم الورقة البحثية RAVENEA، وهو معيار جديد يدمج أكثر من 11,000 وثيقة منسقة من ويكيبيديا لتقييم وتوضيح كيف يعزز التوليد المعزز بالاسترجاع بشكل كبير فهم الثقافة البصرية في النماذج متعددة الوسائط من خلال تحسين الأداء في مهام الإجابة على الأسئلة البصرية التي تركز على الثقافة ووصف الصور.

Jiaang Li, Yifei Yuan, Wenyan Li, Mohammad Aliannejadi, Daniel Hershcovich, Anders Søgaard, Ivan Vulić, Wenxuan Zhang, P (…)2026-02-17
💬 NLP

iQUEST: An Iterative Question-Guided Framework for Knowledge Base Question Answering

تقدم الورقة البحثية iQUEST، وهو إطار عمل تكراري موجه بالأسئلة يجمع بين تفكيك الأسئلة الفرعية والاستدلال الاستباقي المعزز بالشبكات العصبية الرسومية لتحسين أداء الإجابة على أسئلة قواعد المعرفة متعددة القفزات عبر مختلف المعايير والنماذج اللغوية الكبيرة.

Shuai Wang, Yinan Yu2026-02-17