💬 NLP

Implicature in Interaction: Understanding Implicature Improves Alignment in Human-LLM Interaction

تُثبت هذه الورقة أن دمج التضمين اللغوي في الأوامر يحسن بشكل كبير قدرة النماذج اللغوية الكبيرة على استنتاج قصد المستخدم وتوليد استجابات ذات صلة بالسياق، مما يعزز التوافق بين الإنسان والذكاء الاصطناعي وتفضيلات المستخدم، لا سيما بالنسبة للنماذج الأصغر حجماً.

Asutosh Hota, Jussi P. P. Jokinen2026-05-06
💻 computer science

Hierarchical Memorization in Large Language Models: Evidence from Citation Generation

تكشف هذه الدراسة أن هلوسة الاستشهاد في النماذج اللغوية الكبيرة ليست فشلاً ثنائياً، بل هي عملية حفظ هرمية تتدرج فيها الدقة الواقعية لوغاريتمياً خطياً مع تكرار بيانات التدريب، مظهرةً عتبات متميزة وأنماط استدعاء خاصة بالمكونات حيث يتم تعلم العناوين والمؤلفين قبل المجلات أو السنوات أو الحقول الرقمية.

Junichiro Niimi2026-05-06
🤖 machine learning

On-Device Fine-Tuning via Backprop-Free Zeroth-Order Optimization

تُثبت هذه الورقة أن التحسين من الدرجة الصفرية الموفر للذاكرة (MeZO) يُمكّن من الضبط الدقيق للنماذج الأكبر حجماً بكثير من النماذج التقليدية عبر الانتشار العكسي من خلال إجراء الضبط الدقيق على الأجهزة، وذلك عبر إلغاء الحاجة إلى تخزين التنشيطات وحالات المُحسِّن، وبالتالي المقايضة بزيادة في وقت التنفيذ الفعلي مقابل دقة فائقة في ظل قيود الذاكرة الصارمة.

Prabodh Katti, Houssem Sifaou, Sangwoo Park, Bipin Rajendran, Osvaldo Simeone2026-05-06
💬 NLP

Orthographic Constraint Satisfaction and Human Difficulty Alignment in Large Language Models

تقيم هذه الورقة ٣٩ تهيئة عبر ثلاث عائلات من النماذج اللغوية الكبيرة في ٥٨ لغزاً لفظياً، كاشفةً أن الاختلافات بين العائلات وأنماط الصعوبة المتوافقة مع البشر تفوق أهمية توسيع المعلمات، بينما تكشف عن إخفاقات منهجية للنماذج في الكلمات الشائعة ذات الرسم الإملائي غير المعتاد بسبب الاعتماد المفرط على المعقولية التوزيعية.

Bryan E. Tuck, Rakesh M. Verma2026-05-06
💬 NLP

Progress Ratio Embeddings: An Impatience Signal for Robust Length Control in Neural Text Generation

تقدم هذه الورقة البحثية "تضمينات نسبة التقدم" (Progress Ratio Embeddings - PRE)، وهي إشارة جيبية مستمرة تتغلب على عدم استقرار طرق العد التنازلي المنفصلة لتحقيق تحكم قوي وقابل للتعميم في طول النصوص المولدة عصبياً دون المساس بالدقة.

Ivanhoé Botcazou, Tassadit Amghar, Sylvain Lamprier, Frédéric Saubion2026-05-06
💬 NLP

OpenAI GPT-5 System Card

تقدم بطاقة النظام هذه نموذج GPT-5 من OpenAI، وهو نظام ذكاء اصطناعي موحد يتميز بموجه ديناميكي يختار بذكاء بين نماذج التفكير السريع والعميق لتعزيز الفائدة في العالم الحقيقي في مجالات الكتابة، والبرمجة، والصحة، مع تقليل الهلوسة بشكل كبير وفرض ضمانات سلامة صارمة، بما في ذلك التدابير الاحترازية للمخاطر البيولوجية.

Aaditya Singh (Tony), Adam Fry (Tony), Adam Perelman (Tony), Adam Tart (Tony), Adi Ganesh (Tony), Ahmed El-Kishky (Tony) (…)2026-05-06
💻 computer science

Simulated Students in Tutoring Dialogues: Substance or Illusion?

تتناول هذه الورقة نقص تقييم الجودة للطلاب المحاكيين في التدريس المدعوم بالنماذج اللغوية الكبيرة من خلال التعريف الرسمي للمهمة، واقتراح مقاييس تقييم شاملة، وإثبات أنه من خلال الاختبارات المعيارية، بينما يتفوق الضبط الدقيق الخاضع للإشراف وتحسين التفضيلات على التلقين البسيط، لا تزال الأساليب الحالية تظهر أداءً محدوداً في محاكاة سلوك الطالب بشكل واقعي.

Alexander Scarlatos, Jaewook Lee, Simon Woodhead, Andrew Lan2026-05-06
💬 NLP

TIME: Temporally Intelligent Meta-reasoning Engine for Context-Triggered Explicit Reasoning

تقدم الورقة البحثية إطار العمل TIME، وهو إطار للمحاذاة السلوكية يدرب النماذج اللغوية على استدعاء دفعات استدلال صريحة في مكانها ومحفزة سياقياً بناءً على إشارات زمنية، مما يحسن الحساسية الزمنية وكفاءة الاستدلال بشكل كبير مع تقليل عبء الرموز (tokens) بشكل هائل مقارنة بنهج الاستدلال التقليدي المسبق.

Susmit Das2026-05-06
💻 computer science

AfriqueLLM: How Data Mixing and Model Architecture Impact Continued Pre-training for African Languages

تقدم الورقة البحثية AfriqueLLM، وهي مجموعة من النماذج اللغوية الكبيرة المفتوحة التي تم تكييفها مع 20 لغة أفريقية عبر التدريب المسبق المستمر، مظهرةً أن المزج الاستراتيجي للبيانات — بما في ذلك الرياضيات والبرمجة والترجمات الاصطناعية — هو المحرك الرئيسي لمكاسب الأداء، وأن البنيات القوية المقترنة بالبيانات المتوافقة مع المهام أكثر أهمية من حجم النموذج الأساسي أو القدرات متعددة اللغات الأولية.

Hao Yu, Tianyi Xu, Michael A. Hedderich, Wassim Hamidouche, Syed Waqas Zamir, David Ifeoluwa Adelani2026-05-06
💻 computer science

LitVISTA: A Benchmark for Narrative Orchestration in Literary Text

تقدم الورقة البحثية LitVISTA، وهو معيار إرشادي وإطار عمل VISTA Space لتقييم التنسيق السردي في النصوص الأدبية، كاشفةً أن النماذج اللغوية الكبيرة الرائدة الحالية تعاني بشكل منهجي من صعوبة في دمج الوظيفة والبنية السردية رغم قدراتها المتقدمة في الاستنتاج.

Mingzhe Lu, Yiwen Wang, Yanbing Liu, Qi You, Chong Liu, Ruize Qin, Haoyu Dong, Wenyu Zhang, Jiarui Zhang, Yue Hu, Yunpen (…)2026-05-06