💬 NLP

LiveMem: Maintaining Memory State Continuity in Long-Running LLM Inference

تقدم الورقة البحثية LiveMem، وهي طريقة ذاكرة جوهرية للنماذج اللغوية الكبيرة ذات الانتباه الكامل مسبقة التدريب، تحافظ على حالة ذاكرة مستمرة وداعمة ومستقلة عن نافذة السياق النشطة، مما يتيح استمرارية الحالة والاحتفاظ بالمعلومات على المدى الطويل في سيناريوهات الاستدلال طويلة الأمد حيث لا تعود الأدلة التاريخية موجودة في السياق المباشر.

Zhichen Liu, Ruihan Sun, Hengjie Yang, Zipeng Wu, Zhaohan Chen, Xiaofan Zhang, Yang Xu2026-08-04
💬 NLP

MedPRESS: A Multi-turn Benchmark for Patient-Pressure-Induced Medical Sycophancy in LLMs

تقدم الورقة البحثية MedPRESS، وهو معيار تقييم متعدد الأدوار يوضح أن النماذج اللغوية الكبيرة غالباً ما تساوم على السلامة الطبية من خلال الاستجابة لضغط المريض، مما يكشف عن فجوة حرجة في طرق التقييم الحالية التي تعتمد على الأسئلة الثابتة بدلاً من ديناميكيات المحادثة التنافسية.

Saman Sarker Joy, Niloy Farhan2026-08-04
💬 NLP

Who Should Be Generated? Justifying Demographic Targets in Open-Ended Generation

تقترح هذه الورقة إطاراً رسمياً لتبرير الأهداف الديموغرافية في تقييم عدالة التوليد مفتوح النهايات، محاجةً بأن بناء الأهداف هو جزء لا يتجزأ من تقييم العدالة وليس مجرد خطوة تمهيدية، وتثبت من خلال التحليل التجريبي أن التبريرات المختلفة للأهداف (مثل الأولويات الجغرافية مقابل المهنية) تؤدي إلى قياسات عدالة متباينة بشكل كبير.

Zeshen Zheng, Yujia He, Qianmian Lin, Xiangyue Huang, Wenqing Chen2026-08-04
💬 NLP

Romanized Arabic Across Dialects: Views, Usage Patterns, and Linguistic Variation

تقدم هذه الورقة أكبر دراسة بشرية المركز ومتعددة اللهجات لـ "العربيزي" حتى الآن، حيث تجمع بين الرؤى القائمة على الاستطلاع حول تصورات المستخدمين مع إصدار موردين جديدين — مجموعة بيانات محاذاة على مستوى الحرف ومتن متوازٍ — لتحليل معايير الكتابة والتباين اللغوي عبر اللهجات الجزائرية والمصرية واللبنانية والمغربية والتونسية.

Amr Keleg, Ahmed Amine Ben Abdallah, Taha Yassine, Chadi Helwe, Imane Guellil, Nedjma Ousidhoum2026-08-04
💬 NLP

UEmbed: Unified Sparse and Dense Multimodal Embeddings

يقدم UEmbed نموذج تضمين متعدد الوسائط موحداً يعتمد على فك التشفير فقط (decoder-only)، يقوم بتوليد كل من التمثيلات المعجمية المتفرقة والتمثيلات الكثيفة في تمريرة أمامية سببية واحدة، محققاً أداءً رائداً في المعايير المرجعية متعددة الوسائط مع تمكين التطبيقات الوكيلية الفعالة.

Tingyu Song, Mingxin Li, Yanzhao Zhang, Dingkun Long, Pengjun Xie, Zhijie Nie, Yilun Zhao, Shu Wu2026-08-04
🤖 machine learning

GradCuit: Credit-Assigned Gradient Flow Enables Robust and Interpretable Test-Time Latent Reasoning

يقدم GradCuit إطار عمل جديداً للاستدلال أثناء وقت الاختبار يعمل على تحسين الحالات الكامنة الوسيطة داخل طبقات المحولات (Transformer) باستخدام تدفق التدرج المباشر من النتائج النهائية، محققاً دقة ومتانة وقابلية تفسير فائقة مقارنة بالطرق الحالية من خلال تمكين النماذج من تكييف عمليات الاستدلال الداخلية الخاصة بها بدلاً من مجرد إعادة توليد المخرجات.

Zhaoxin Yu, Qi Shen, Hengli Li, Zhaowei Zhang, Song-Chun Zhu, Chi Zhang, Zilong Zheng2026-08-04
💬 NLP

AURORA-LM: Autoencoding Unified Representation for Continuous-Latent Diffusion Language Modeling

يُعدُّ AURORA-LM نموذج لغة انتشار ذي كامن مستمر يحقق أداءً فائقاً من خلال فصل بناء تمثيل نصي عالي السعة وقابل للفك عن نمذجة توزيعه، وذلك باستخدام مشفر-مفكك يعتمد على الاستعلام ومحول انتشار سببي-كتلي يتم تدريبه باستخدام مطابقة التدفق على وحدات معالجة Ascend NPU.

Jiajun Liang, Yucheng Liao, Yukang Cao, Jiazhe Wei, Ken Li, Wende Tan, Jiankun Zhang, ZY Cui, Jingkang Yang, Liucheng Gu (…)2026-08-04
💬 NLP

Self-reflecting Large Language Models: A Hegelian Dialectical Approach

تقترح هذه الورقة إطار عمل للتأمل الذاتي قائم على الجدلية الهيجلية للنماذج اللغوية الكبيرة، يقوم بتوليف الأفكار المتعارضة بشكل تكراري لتعزيز كل من الابتكار العلمي الجديد والاستنتاج التصحيحي للأخطاء، مما يظهر مكاسب أداء كبيرة عبر الاختبارات المرجعية الرياضية والرمزية والمعرفية المكثفة.

Sara Abdali, Michael Solodko, Can Goksen, Saeed Amizadeh, Julie E. Maybee, Kazuhito Koishida, Pashmina Cameron2026-08-03
💬 NLP

Vision Meets Language: A RAG-Augmented YOLOv8 Framework for Coffee Disease Diagnosis and Farmer Assistance

تقترح هذه الورقة إطار عمل جديد للزراعة الدقيقة يدمج نموذج YOLOv8 للكشف عن أمراض أوراق القهوة مع نظام التوليد المعزز بالاسترجاع (RAG) لتزويد المزارعين بتشخيصات واستراتيجيات علاجية بلغة طبيعية دقيقة، وخالية من الهلوسة، وسياقية.

Semanto Mondal2026-08-03
💬 NLP

On the Fundamental Impossibility of Hallucination Control in Large Language Models

تجادل هذه الورقة بأن الهلوسة في النماذج اللغوية الكبيرة لا مفر منها جوهرياً بسبب المقايضات المتأصلة في تجميع المعرفة الداخلية، مما يثبت أنه بينما يمكن للأدلة الخارجية أن تتحقق من دعم الإجابة، لا توجد آلية داخلية يمكنها ضمان الحقيقة الواقعية أو حل الاختلالات الدلالية التي تؤدي إلى التزييف.

Michał P. Karpowicz2026-08-03