💬 NLP

Mitigating Exploration Bias in RL for Multi-Instruction Following

تتناول هذه الورقة البحثية انحياز الاستكشاف نحو التعليمات السهلة في اتباع التعليمات المتعددة القائم على التعلم التعزيزي، وذلك عبر اقتراح إطار عمل ثنائي المراحل يجمع بين التمهيد السلوكي لتنشيط التعليمات الصعبة والمكافآت المدركة للندرة لإعطائها الأولوية، مما يحسن أداء النموذج بشكل كبير عبر المعايير القابلة للتحقق.

Mian Zhang, Yueqin Yin, Kaiyu He, Peilin Wu, Xinlu Zhang, Mingyuan Zhou, Zhiyu Zoey Chen2026-08-26
💬 NLP

Does Episodic Memory Help Close the Lexical Frequency Gap in Sensitivity to Syntactic Contrasts? A Test Using Retrieval-Augmented Language Models

تُثبت هذه الورقة أن النماذج اللغوية المعززة بالاسترجاع، والتي تُجسد آلية ذاكرة حصينية عرضية، يمكنها تضييق الفجوة في التردد المعجمي في الحساسية النحوية بشكل كبير من خلال الاستفادة من تجارب ماضية محددة، لا سيما عندما يعتمد الاسترجاع على التشابه الهيكلي بدلاً من التشابه الدلالي.

Jing Liu, Najoung Kim2026-08-26
💬 NLP

Continual Visual Learning under Evolving Semantic Concept Shift

يقدم هذا البحث إطار عمل SemReWrite، المصمم للتعامل مع التحولات المتطورة في المفاهيم الدلالية في النماذج البصرية التأسيسية من خلال التحديث الانتقائي لخرائط الربط بين المرئيات والدلالات التي أصبحت عتيقة مع الحفاظ على المعرفة الصالحة، وهو ما تم التحقق من صحته عبر معيار جديد (EvoShift-Bench) ومقاييس تقييم متخصصة.

Ismail Lamaakal, Chaymae Yahyati, Yassine Maleh, Khalid El Makkaoui, Ibrahim Ouahbi2026-08-26
💬 NLP

Wontopos Tablet 2: Measuring Multilingual and Multimodal Memory Retrieval Without Lexical Matching

تقدم هذه الورقة Wontopos Tablet 2، وهو محرك ذاكرة طويلة الأمد متعدد الوسائط وخالٍ من المعجم، يحقق أداءً عالياً في الاسترجاع عبر اللغات للنصوص والصور الخالية من التعليقات، بينما يثبت بشكل حاسم أن مقاييس التقييم القياسية غير مستقرة للغاية وأن نماذج الاسترجاع الكثيف الحالية تفشل في التعميم عبر اللغات.

Sunwoo Kim2026-08-26✓ Author reviewed
💬 NLP

Investigating Knowledge Transfer Across Interactive Dialogue Games

تتقصى هذه الورقة البحثية انتقال المعرفة عبر ألعاب الحوار التفاعلية من خلال تحليل النماذج اللغوية الكبيرة التي تم ضبطها دقيقاً على مجموعة اختبار Clembench، كاشفةً أن ألعاب الاستكشاف البصري المكاني تحقق أفضل انتقال، بينما تفشل نواقل المهام القائمة على التشابه في التقاط أنماط القابلية للانتقال المعقدة.

Filippo Momentè, Mir Nafis Sharear Shopnil, Andrea de Varda, Pavel Merinov, Raffaella Bernardi, Oswald Lanz, Alessandro (…)2026-08-26
💬 NLP

When Less Is More: An Empirical Study of Minimal Responses in Counseling Dialogues and the Behavior of LLMs

تثبت هذه الورقة تجريبياً أنه في حين تُعد الاستجابات الدنيا (minimal responses) حاسمة لفعالية الإرشاد البشري، إلا أنها ممثلة تمثيلاً ناقصاً بشكل كبير في الحوارات التي تولدها النماذج اللغوية الكبيرة، وغالباً ما يتم التقليل من قيمتها من قبل أطر التقييم الحالية، حيث تكافح النماذج لنشرها بشكل مناسب دون تعليمات صريحة.

Zhiyang Qi2026-08-26
💬 NLP

PARTAB: Partition-Aware Reasoning with Structured Evidence for Scalable Table Understanding

تقدم الورقة البحثية إطار عمل PARTAB، الذي يعزز الاستدلال القابل للتوسع على الجداول من خلال بناء واجهة أدلة مهيكلة ومدركة للتقسيم، تختار هرمياً مناطق صفوف وأعمدة متماسكة دلالياً لتحسين تحديد موقع الأدلة وتقليل تعقيد السياق بالنسبة للنماذج اللغوية الكبيرة.

Md Mahadi Hasan Nahid, Davood Rafiei2026-08-26
🤖 AI

Paritok-4B: Intent-Conditioned Context Compression for Coding Agents

يُعد Paritok-4B نموذج LoRA مفتوح المصدر، مشروط بالنية، واستخراجي بـ 4 مليارات معلمة، يقوم بضغط سياقات وكلاء البرمجة إلى حوالي 25% من حجمها الأصلي مع الحفاظ على 86.5% من جودة الحل، مما يوفر بديلاً فعالاً من حيث التكلفة للنماذج اللغوية الكبيرة الرائدة والمكلفة لتقليل فواتير الرموز (tokens) دون التأثير بشكل كبير على الأداء.

Jiayu Shi, Luzhuo Chen2026-08-26
💬 NLP

MemUse: Moving Memory Evaluation from Direct QA to Natural Integration in Long-Term Human-AI Conversation

تتحدى هذه الورقة البحثية صحة معايير الإجابة المباشرة على الأسئلة (Direct QA) التقليدية لتقييم ذاكرة النماذج اللغوية الكبيرة الحوارية، من خلال إثبات أنه بينما تفشل هذه المقاييس في الارتباط برضا المستخدم، فإن إطار عمل جديداً يسمى "MemUse"، والذي يقيم التكامل الطبيعي للحقائق المسترجعة في الحوار، يتنبأ بنجاح بتجربة المستخدم في التفاعلات طويلة الأمد بين الإنسان والذكاء الاصطناعي.

Ryuichi Sumida, Koji Inoue, Tatsuya Kawahara2026-08-26