💬 NLP

Predictive Prefetching for Retrieval-Augmented Generation

تقترح هذه الورقة إطار عمل استرجاع غير متزامن متطور لعملية التوليد المعزز بالاسترجاع، يستخدم الجلب المسبق التنبؤي بناءً على السوابق الدلالية لتقليل زمن الاستجابة بشكل كبير وتحسين زمن الوصول إلى أول رمز (time-to-first-token) مع الحفاظ على جودة إجابات مماثلة للنماذج المتزامنة المرجعية.

Wuyang Zhang, Shichao Pei2026-05-19
💬 NLP

PROTEA: Offline Evaluation and Iterative Refinement for Multi-Agent LLM Workflows

تُعد PROTEA واجهة موحدة للتحسين القائم على الاختبار غير المتصل بالإنترنت لسير عمل النماذج اللغوية الكبيرة متعددة الوكلاء، والتي تعمل على تحديد مواضع الاختناق محلياً من خلال التقييم القائم على الرسوم البيانية والتقييم العكسي، مما يمكّن المطورين من تحرير والتحقق من مراجعات الأوامر البرمجية بشكل تكراري لتحسين أداء النظام بشكل كبير.

Kazuki Kawamura, Satoshi Waki, Kei Tateno2026-05-19
💬 NLP

A Data-Efficient Path to Multilingual LLMs: Language Expansion via Post-training PARAMΔ\Delta Integration into Upcycled MoE

تقدم هذه الورقة طريقة فعالة من حيث استهلاك البيانات تسمى \method تقوم بترقية النماذج الكثيفة إلى بنيات "خليط الخبراء" (Mixture-of-Experts) وتدمج فروق المعلمات (parameter deltas) ما بعد التدريب لتوسيع القدرات متعددة اللغات دون الحاجة إلى تدريب مسبق مستمر مكلف أو محاذاة معقدة، مما يوازن بفعالية بين اكتساب لغات جديدة والحفاظ على قدرات النموذج الأصلية.

Hao Zhou, Tianhao Li, Zhijun Wang, Shuaijie She, Linjuan Wu, Hao-Ran Wei, Baosong Yang, Jiajun Chen, Shujian Huang2026-05-19
💬 NLP

How Loud Rumbles Hit Newsstands: A Data Analysis of Coverage and Spatial Bias in German News about Landslides Around the World

تحلل هذه الورقة 25 عاماً من التغطية الصحفية الألمانية للانهيارات الأرضية العالمية للكشف عن تحيزات في التغطية المكانية، مثل الإفراط في الإبلاغ عن جنوب وغرب أوروبا، مما يسلط الضوء على عدم المساواة في الاهتمام الإعلامي بالكوارث الدولية.

Brielen Madureira, Andreas Niekler, Marc Keuschnigg, Mariana Madruga de Brito2026-05-19
💬 NLP

How Good LLMs Are at Answering Bangla Medical Visual Questions? Dataset and Benchmarking

تقدم هذه الورقة البحثية BanglaMedVQA، وهي أول مجموعة بيانات ومعيار معتمد سريريًا للإجابة على الأسئلة البصرية الطبية باللغة البنغالية، والتي كشفت أن النماذج التأسيسية الرائدة حاليًا، بما في ذلك Gemini وGPT-4.1 mini، تؤدي بشكل ضعيف للغاية في المهام التشخيصية المتخصصة بسبب التحديات المتأصلة في اللغات ذات الموارد المنخفضة والاستدلال الطبي المعقد.

Rafid Ahmed, Intesar Tahmid, Mir Sazzat Hossain, Tasnimul Hossain Tomal, Md Fahim, Md Farhad Alam Bhuiyan2026-05-19
💬 NLP

TRACE: Trajectory Correction from Cross-layer Evidence for Hallucination Reduction

تُعد TRACE خوارزمية حتمية، لا تعتمد على التدريب وتعمل أثناء مرحلة الاستدلال، حيث تعمل على تقليل الهلوسة في النماذج اللغوية الكبيرة من خلال الاختيار الديناميكي للطبقة المثلى وعامل التصحيح (مثل العكس القياسي أو استعادة الحالة السابقة) بناءً على مسار المرشح عبر الطبقات لكل مدخل، مما يحقق مكاسب كبيرة في الدقة عبر 15 نموذجاً دون الحاجة إلى بيانات خارجية أو ضبط دقيق.

Tej Sanibh Ranade2026-05-19
💬 NLP

Scalable Environments Drive Generalizable Agents

تجادل هذه الورقة الموقعة في أن تحقيق وكلاء قابلين للتعميم حقاً يتطلب تحويل التركيز من مجرد توسيع نطاق كميات المهام إلى "توسيع نطاق البيئة" —أي توسيع تنوع مجموعات القواعد القابلة للتنفيذ التي يواجهها الوكلاء— وتقترح تصنيفاً موحداً ونماذج بناء منهجية لمعالة هذا التحول في التوزيع على مستوى العالم بشكل نظامي.

Jiayi Zhang, Fanqi Kong, Guibin Zhang, Maojia Song, Zhaoyang Yu, Jianhao Ruan, Jinyu Xiang, Bang Liu, Chenglin Wu, Yuyu (…)2026-05-19
💬 NLP

Leveraging Graph Structure in Seq2Seq Models for Knowledge Graph Link Prediction

تقدم هذه الورقة البحثية GA-S2S، وهو إطار عمل مبتكر يجمع بين مشفر ومفكك شفرة من نوع T5-small وشبكة انتباه رسومية علاقية لترميز الميزات النصية وطوبولوجيا الرسم البيق الفرعي من فئة kk-hop بشكل مشترك، مما يؤدي إلى تحسين دقة التنبؤ بالروابط في الرسوم البيانية للمعرفة بشكل كبير مقارنة بالنماذج المرجعية القائمة على التسلسل إلى تسلسل (Seq2Seq).

Luu Huu Phuc, Ratan Bahadur Thapa, Mojtaba Nayyeri, Jingcheng Wu, Evgeny Kharlamov, Steffen Staab2026-05-19
🔬 physics

SIREM: Speech-Informed MRI Reconstruction with Learned Sampling

إنَّ SIREM هو إطار عمل لإعادة بناء صور الرنين المغناطيسي المعتمد على الكلام، والذي يستفيد من الصوت المتزامن كأولوية عابرة للأنماط للتنبؤ بهياكل المجرى الصوتي ودمجها مع بيانات الفضاء-k ناقصة العينات، مما يتيح تصويراً عالي الإنتاجية وفي الوقت الفعلي مع الحفاظ على التفاصيل التشريحية.

Md Hasan, Nyvenn Castro, Daiqi Liu, Lukas Mulzer, Jana Hutter, Jonghye Woo, Moritz Zaiss, Andreas Maier, Paula A. Perez- (…)2026-05-19
💬 NLP

Context Memorization for Efficient Long Context Generation

تقترح هذه الورقة البحثية "ذاكرة حالة الانتباه" (attention-state memory)، وهي طريقة لا تتطلب تدريباً تعمل على إخراج معلومات البادئة (prefix) إلى جدول بحث خفيف الوزن من حالات الانتباه المحسوبة مسبقاً للتغلب على تلاشي التأثير ومحدودية التوسع الخطي لعمليات الاستدلال التقليدية المعززة بالبادئات، وذلك بهدف تحسين الدقة وتقليل زمن الاستجابة في توليد النصوص ذات السياق الطويل.

Yasuyuki Okoshi, Hao Mark Chen, Guanxi Lu, Hongxiang Fan, Masato Motomura, Daichi Fujiki2026-05-19