💬 NLP

Intent Speaks Louder: Controllable User Simulation Beyond Response Imitation

تقدم هذه الورقة البحثية UserIDA، وهو محاكي مستخدم قابل للتحكم يفصل صراحةً بين نية التفاعل المحلي والتعبير اللغوي من خلال واجهة نوايا سداسية المسارات وتعلم تعزيزي مُعاير للنوايا، مما يحقق دقة في النوايا وجودة في الحوار أعلى بكثير من النماذج المرجعية الحالية.

Bo Wang, Ruixing Zhang, Yunqi Liu, Yang Zhang, Liangzhe Han, Tongyu Zhu, Leilei Sun2026-08-11
💬 NLP

ZetaGPT: A Reference Implementation of Positional--Encoding--Free State--Space--Attention Language Models

تقدم هذه الورقة البحثية ZetaGPT، وهو نموذج لغوي صغير مفتوح المصدر يلغي التشفيرات الموضعية الصريحة من خلال دمج معادلات فضاء الحالة السببية لتشفير المعلومات التسلسلية ضمنياً قبل عملية الانتباه الذاتي، مع توفير مسار تدريب كامل من البداية إلى النهاية لأغراض البحث والتعليم.

Róisín Luo2026-08-11
🤖 machine learning

Depth-adaptive Inference of Looped Language Models via Continuous Depth Batching

تقدم هذه الورقة البحثية "التجميع المستمر للعمق" (CDB)، وهو إطار جدولة مبتكر يتيح استنتاجاً فعالاً ومتكيفاً مع العمق من البداية إلى النهاية للنماذج اللغوية الحلقية، وذلك عبر فصل تكرارات الحلقة عن مراحل الحدود وتداخل الجدولة مع الحوسبة في وحدة معالجة الرسومات، مما يحقق إنتاجية أعلى بما يصل إلى 1.9 ضعفاً وزمن انتقال أقل بكثير مقارنة بالطرق القياسية.

Kristian Schwethelm, Daniel Rueckert, Georgios Kaissis2026-08-11
💬 NLP

Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning

تقترح هذه الورقة AlignXada، وهو إطار عمل للتعلم التلوي (meta-learning) لا يتطلب تدريباً، يستخدم التعلم التعزيزي اللفظي لتحويل ملخصات تفضيلات المستخدم الشاملة إلى تمثيلات موجزة ومحددة للمهام، مما يؤدي إلى تحسين أداء تخصيص النماذج اللغوية الكبيرة عبر مهام متنوعة مع تقليل طول السياق بشكل كبير والتفوق على نهج التوليد المعزز بالاسترجاع (RAG).

Yuting Liu, Wei Wu, Jianzhe Zhao, Guibing Guo2026-08-11
💬 NLP

TCS-BENCH: Benchmarking State-of-the-Art Generative AI Theoretical Computer Science Research Ability

تقدم هذه الورقة TCS-Bench، وهو معيار مرجعي جديد مصمم لتقييم قدرات النماذج اللغوية الكبيرة في إثبات النظريات على مستوى البحث العلمي باستخدام مسائل من أبرز المحافل العلمية في علوم الحاسوب النظرية، مصحوبة بوكيل تحقق عالي الدقة للتحقق من صحة البراهين المولدة مقابل أحكام الخبراء البشريين.

Vincent Cohen-Addad, Dimitris Paparas, Ernest van Wijland, Max Springer, Julien Canitrot-Paradis, Honghao Lin, David Woo (…)2026-08-11
💬 NLP

Se-DPO: Self-Evolving Token Credit for Direct Preference Optimization

تقدم هذه الورقة Se-DPO، وهي طريقة تضبط ديناميكيًا الائتمان على مستوى الرمز (token-level credit) بناءً على إشارات المكافأة الداخلية المتطورة والثقة للتغلب على قيود التجميع الموحد الثابت في تحسين التفضيل المباشر (Direct Preference Optimization)، محققةً مكاسب أداء كبيرة في اختبارات معيارية مثل AlpacaEval 2 وArena-Hard.

Wenxiao Zhao, Shu Wang, Ying Nian Wu2026-08-11
💬 NLP

Measuring the Wrong Thing: Internal Harmfulness Scores Anti-Rank Successful Jailbreaks

تُظهر هذه الورقة أن درجات السلامة الداخلية، التي تعتمد على قياسات الانتباه المعتمدة على المطالبة، تفشل في التنبؤ بنجاح عمليات كسر الحماية لأن الهجمات المغلفة تغير كلاً من المحتوى وإحداثيات القياس، مما يتسبب في جعل درجات النية الضارة تعكس ترتيباً عكسياً للنتائج الضارة الفعلية عبر نماذج وعائلات هجوم متعددة.

Mingyu Luo, Ming Deng, Zilang Qiu, Yiming Cheng, Ci Tao, Xue Tan, Sijin Sun, Yangfu Li, Ping Chen, Jun Dai, Xiaoyan Sun2026-08-11
💬 NLP

Listwise Cross-Encoder Fine-Tuning vs. Agentic Instruction Tuning for LLM Rerankers: A Systematic Study in Medical Procedure Reranking

تُثبت هذه الورقة أن مشفرًا تقاطعيًا (cross-encoder) صغيرًا، تم ضبطه بدقة باستخدام طريقة القائمة (listwise fine-tuning)، يتفوق بشكل كبير على نموذج لغوي كبير (LLM) أكبر حجمًا ومضبوط بالتعليمات بأسلوب الوكيل (agentic instruction-tuned) في إعادة ترتيب الإجراءات الطبية للتأمين الصحي، مما يوفر دقة وكفاءة فائقتين بـ 37 ضعفًا أقل من حيث عدد المعلمات.

Matan Fainzilber, Shlomit Plavner2026-08-11
💬 NLP

REFRAMED: Towards Realistic Audio Description Generation for Movies

تقدم هذه الورقة البحثية REFRAMED، وهي مجموعة بيانات ومعيار عالي الجودة يعيد صياغة توليد الوصف الصوتي كمسألة اتخاذ قرار مشتركة لتحديد كل من المحتوى والتوقيت، مما يؤسس لأساس جديد لأبحاث إمكانية الوصول الواقعية للأفلام التي تكشف الفجوة الكبيرة بين الأنظمة الحالية للذكاء الاصطناعي وأداء الخبراء البشريين.

Igor Sterner, Mirella Lapata, Alex Lascarides, Frank Keller2026-08-11
💬 NLP

PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models

تقدم هذه الورقة PragMatch، وهو معيار ضبط مصمم لتقييم قدرة نماذج اللغة الرؤية الكبيرة على التمييز بين عدم الاتساق البراغماتي الحقيقي وعدم التطابق السطحي عبر الوسائط، مما يكشف أن النماذج الحالية تعتمد بشكل كبير على إشارات مختصرة مثل الإشارات المعجمية والأسلوبية بدلاً من الاستدلال متعدد الوسائط الحقيقي.

Zhanna Mukhametsharip (Saarland University, Germany), Vera Demberg (Saarland University, Germany, Max Planck Institute f (…)2026-08-11