💬 NLP

Energy- and Memory-Efficient PEFT Methods for Personalized On-Device SLMs on Consumer GPUs

تُثبت هذه الورقة أن الجمع بين النماذج اللغوية الصغيرة المدمجة وطريقة الضبط الدقيق (LoRA+) يقدم الحل الأكثر كفاءة في استهلاك الطاقة للنشر الشخصي على الأجهزة، بينما تُعد طريقة (QLoRA) البديل الأمثل لتوفير الذاكرة للبنى القائمة على المحولات (Transformer).

Kuanysh Akhmetzhanov, Jurn-Gyu Park2026-08-06
🤖 machine learning

ODRA: Synthesizing Cognitive Behavioral Therapy Sessions with Structured Chain-Of-Thought and Dynamic Patient Resistance

تقدم الورقة البحثية إطار عمل ODRA، وهو إطار عمل مبتكر يقوم بتخليق جلسات علاج معرفي سلوكي واقعية عبر الجمع بين استدلال "سلسلة الأفك" المنظم ومنسق مقاومة ديناميكي للتغلب على تملق المريض، مما ينتج بيانات تدريب عالية الدقة تعمل على تحسين الأداء العلاجي اللاحق بشكل كبير.

Javier Rodriguez-Juan, Hiba Arnaout, Jose Garcia-Rodriguez, David Tomás, Iryna Gurevych2026-08-06
🤖 AI

EuroExec: Frontier Language Models Fall Short of Expert Judgment on European Executive Decision Tasks

تقدم هذه الورقة EuroExec، وهو معيار لـ 413 مهمة تنفيذية أوروبية من واقع العالم الحقيقي تم تقييمها بواسطة خبراء بشريين، كاشفةً أن أقوى النماذج اللغوية الكبيرة الرائدة لا تزال تقصر بشكل كبير عن المعايير البشرية المهنية، حيث لم تحل سوى 56.9% من المهام وتتفوق عليها باستمرار المراجع المكتوبة من قبل الخبراء.

Pau Arnal, Khaled Denfir, Danylo Smahliuk, Amrut Avhad, Marcus A. Castro2026-08-06
🤖 machine learning

Relational Response Fields: A General Theory of Black-Box LLM Response Consistency and Recovery

تقدم هذه الورقة إطار عمل "حقل الاستجابة العلائقي" (RRF) لتعريف وقياس الصعوبة الجوهرية لاستعادة استجابات النماذج اللغوية الكبيرة (LLM) المتسقة عبر مقياس γk(D,A)\gamma_k(D,A)، مُثبتةً أن الاستعادة تعتمد على التناظرات العلائقية والمرتكزات الموثوقة بدلاً من مجرد الاتساق، مع إثبات الحدود الأساسية على القابلية للتمييز وتوفير خوارزميات لإصلاح الحقل المتناثر.

Song Zichen2026-08-06
💬 NLP

STRIVE: Probing Reasoning Limits in Graded Plausibility Generation and Evaluation

تقدم الورقة البحثية إطار عمل STRIVE، وهو إطار يعتمد على النماذج اللغوية الكبيرة (LLM) لأتمتة توليد وتقييم مجموعات الأحداث المحكومة للدراسات النفسية اللغوية من خلال تغيير مستويات المعقولية، مما يثبت أن دمج الاستدلال العالمي والتحسين الموجه من قبل المُقيّم يحسن بشكل كبير جودة التوليد والاتفاق البشري، رغم أن الأحداث القريبة من حدود المعقولية لا تزال تتطلب إشرافاً بشرياً.

Bhiman Kumar Baghel, Anna Chrabaszcz, Tessa Warren, Michael Walsh Dickey, Haley C. Dresang, Xiang Lorraine Li2026-08-06
🤖 machine learning

Relevant but Incomplete: Referential Dangling as a Paradigm-Level Failure Mode in Hard Prompt Compression

تحدد هذه الورقة "التعليق المرجعي" (referential dangling) بوصفه نمط فشل حرج في ضغط المطالبات الصلبة (hard prompt compression)، حيث يؤدي اختيار الرموز المستقلة إلى فصل أزواج الأدلة المعتمدة على بعضها البعض، مما يتسبب في انخفاضات كبيرة في الدقة يمكن استرداد جزء كبير منها من خلال التحسين من أجل كل من الصلة والكمال المرجعي.

Zhengpei Hu, Kai Li, Dapeng Fu, Xuechao Zou, Yuanhao Tang, Yue Li, Tengfei Cao, Jianqiang Huang2026-08-06
💬 NLP

The Personalization Mirage: How LLMs Fabricate User Profiles, and Why Self-Monitoring Misleads

تقدم هذه الورقة MirageBench لتكشف أن النماذج اللغوية الكبيرة المخصصة تفبرك سمات المستخدم عالميًا من خلال الاستنتاج المفرط المنتشر، وهي ظاهرة تفشل آليات المراقبة الذاتية في اكتشافها وغالبًا ما ترتبط عكسيًا بمعدلات الخطأ الفعلية، مما يثبت الحاجة الماسة للتحقق الخارجي بدلاً من التقييم الذاتي للنموذج.

Yushi Sun, Yanjie Zhang, Rui Sheng2026-08-06
💬 NLP

When Memory Lies: An Empirical Study of Spatial Memory Staleness in VLM Agents

تكشف هذه الدراسة التجريبية أن وكلاء النماذج اللغوية البصرية (VLM) المعززة بالذاكرة غالباً ما يفشلون في اكتشاف تقادم الذاكرة المكانية عندما تتعارض الملاحظات البصرية مع النصوص المخزنة، مما يؤدي إلى مخاطر سلامة جسيمة حيث يؤدي الاعتماد على الذاكرة القديمة إلى زيادة معدلات الفشل أكثر من عدم امتلاك ذاكرة على الإطلاق، في حين تظل آليات التدقيق الحالية غير كافية لحل صراعات التأسيد واتخاذ القرار هذه بشكل كامل.

Yushi Sun, Yanjie Zhang2026-08-06
💬 NLP

Causal Evidence Extraction and Triangulation in Crisis Reports using Large Language Models: A ReliefWeb-based Study

تقدم هذه الورقة بحثاً لخط معالجة يتكون من مرحلتين لنماذج اللغات الكبيرة وإطار عمل للتثليث يعمل بفعالية على استخراج وتجميع الأدلة السببية المهيكلة من التقارير الإنسانية، محققاً دقة عالية في تحديد الأثر الإيجابي للمساعدات النقدية على النتائج المتعلقة بالغذاء.

Yuanjun Zhang, Mourad Oussalah2026-08-06
🤖 AI

Breaking the Curse ofMultilinguality inMany-to-Many Speech-to-Text Translation via a Resource-AwareMixture of Speech Encoders

تقدم الورقة البحثية إطار عمل MSRT، وهو إطار عمل مبتكر يستخدم مزيجاً من مشفرات الكلام المدركة للموارد واستراتيجية تعلم منهجي مكونة من خمس مراحل للتغلب على لعنة تعدد اللغات في ترجمة الكلام إلى نص، محققاً أداءً هو الأفضل في فئته عبر 45 لغة مع الحد الأدنى من متطلبات البيانات، مع تحسين قدرات الموارد المنخفضة في الوقت ذاته دون المساس بأداء الموارد العالية.

Yexing Du, Kaiyuan Liu, Youcheng Pan, Bo Yang, Chengpeng Fu, Yu Wang, Ming Liu2026-08-06