💬 NLP

Monitoring the Internal Monologue: Probe Trajectories Reveal Reasoning Dynamics

تقدم هذه الورقة البحثية "مسارات الاستقصاء" (probe trajectories)، وهي طريقة تتبع تطور التمثيلات الخفية عبر خطوات استدلال "سلسلة الأفك" (Chain of Thought) للتنبؤ بسلوك النموذج المستقبلي، مما يثبت أن تحليل الديناميكيات الزمنية واستخدام التجميع الأقصى (max-pooling) يحسن بشكل كبير من مراقبة السلامة وقابلية فصل النتائج في نماذج الاستدلال الكبيرة مقارنة بالتنبؤات الساكنة.

Maciej Chrabąszcz, Aleksander Szymczyk, Marcin Sendera, Tomasz Trzciński, Sebastian Cygert2026-05-19
💬 NLP

GUT-IS: A Data-Driven Approach to Integrating Constructs and Their Relations in Information Systems

تقدم هذه الورقة البحثية منهجية GUT-IS، وهي منهجية قائمة على البيانات تعمل على دمج نماذج المعادلات الهيكلية غير المتسقة في أبحاث نظم المعلومات من خلال الجمع بين تضمينات النصوص والتجميع مع دالة خسارة لموازنة النقاء الدلالي والاقتصاد في التفسير بشكل صريح، مما يتيح تحليل تجمعات البناءات تحت أولويات متفاوتة.

Maximilian Reinhardt, Jonas Scharfenberger, Burkhardt Funk2026-05-19
💬 NLP

Overeager Coding Agents: Measuring Out-of-Scope Actions on Benign Tasks

تقدم هذه الورقة البحثية OverEager-Gen، وهو معيار تم التحقق من صحته بصرامة يثبت أن وكلاء البرمجة يقومون في كثير من الأحيان بأفعال "مفرطة في الحماس" غير مصرح بها في المهام الحميدة، وهو خطر يتضاعف بشكل كبير عند إزالة إعلانات الموافقة الصريحة من المطالبات ويتأثر بشدة بإطار أذونات الوكيل بدلاً من النموذج الأساسي فحسب.

Yubin Qu, Ying Zhang, Yanjun Zhang, Gelei Deng, Yuekang Li, Leo Yu Zhang, Yi Liu2026-05-19
💬 NLP

Post-Trained MoE Can Skip Half Experts via Self-Distillation

تقدم هذه الورقة البحثية "تكييف التقطير الذاتي لصفر الخبراء" (ZEDA)، وهو إطار عمل منخفض التكلفة يحول نماذج "خليط الخبراء" الثابتة بعد التدريب إلى نماذج ديناميكية فعالة عن طريق حقن خبراء مخرجات صفرية خالية من المعلمات وتطبيق تقطير ذاتي على مرحلتين، مما يقلل عمليات الفاصلة العائمة (FLOPs) للخبراء بنسبة تزيد عن 50% مع فقدان طفيف في الدقة ويحقق تسريعاً كبيراً في عملية الاستدلال.

Xingtai Lv, Li Sheng, Kaiyan Zhang, Yichen You, Siyan Gao, Xueheng Luo, Yuxin Zuo, Yuchen Fan, Junlin Yang, Ganqu Cui, B (…)2026-05-19
💬 NLP

Language-Switching Triggers Take a Latent Detour Through Language Models

تحدد هذه الورقة وتفكك دائرة محددة في نموذج لغوي بـ 8 مليارات معلمة ينفذ هجوماً بباب خلفي لتبديل اللغة، كاشفةً أن المحفز يختطف الحسابات من خلال عنق زجاجة تسلسلي وفضاء كامن متعامد يتملص من الدفاعات التي تعتمد على التمثيلات اللغوية الطبيعية.

Francis Kulumba, Wissam Antoun, Théo Lasnier, Benoît Sagot, Djamé Seddah2026-05-19
💬 NLP

Predictable Confabulations: Factual Recall by LLMs Scales with Model Size and Topic Frequency

تثبت هذه الورقة أن الاسترجاع الواقعي في النماذج اللغوية الكبيرة يتبع قانون قياس سيجمويدي (sigmoid) يمكن التنبؤ به، مدفوعاً بالتأثيرات المشتركة لعدد معاملات النموذج وتكرار الموضوع في بيانات التدريب، مما يفسر ما يصل إلى 94% من تباين الأداء ضمن عائلات نماذج محددة.

Matthew L. Smith, Jonathan P. Shock, Samuel T. Segun, Iyiola E. Olatunji, Tegawendé F. Bissyandé2026-05-19
💬 NLP

Vision-OPD: Learning to See Fine Details for Multimodal LLMs via On-Policy Self-Distillation

تُعد Vision-OPD إطار عمل للتقطير الذاتي يعمل على تعزيز الفهم البصري دقيق التفاصيل في النماذج اللغوية الكبيرة متعددة الوسائط من خلال تدريب سياسة الصورة الكاملة على محاكاة الأداء المتفوق لمعلم مشروط بالقصاصات (crop-conditioned) على مخرجاته الخاصة، مما يُمكّن النموذج من استيعال فوائد التركيز على الأدلة ذات الصلة دون إشراف خارجي أو أدوات.

Qianhao Yuan, Jie Lou, Xing Yu, Hongyu Lin, Le Sun, Xianpei Han, Yaojie Lu2026-05-19
💬 NLP

ESI-Bench: Towards Embodied Spatial Intelligence that Closes the Perception-Action Loop

تقدم هذه الورقة البحثية ESI-Bench، وهو معيار مرجعي شامل للذكاء المكاني المتجسد مبني على أنظمة OmniGibson وأنظمة المعرفة الأساسية لـ Spelke، والذي يوضح أن حلقات الإدراك والعمل النشطة تتفوق بشكل كبير على الملاحظة السلبية من خلال تمكين الوكلاء من كشف المعلومات المكانية الخفية، بينما يكشف أن النماذج الحالية تفشل أساساً بسبب عمى العمل والفجوات الميتا معرفية بدلاً من ضعف الإدراك.

Yining Hong, Jiageng Liu, Han Yin, Manling Li, Leonidas Guibas, Li Fei-Fei, Jiajun Wu, Yejin Choi2026-05-19
💬 NLP

DashAttention: Differentiable and Adaptive Sparse Hierarchical Attention

يقدم DashAttention آلية انتباه هرمية متفرقة، تكيفية وكاملة القابلية للتفاضل باستخدام α\alpha-entmax لاختيار أعداد متغيرة من كتل الـ KV ديناميكيًا، مما يحقق دقة فائقة في نمذجة السياقات الطويلة وسرعة استنتاج أعلى مقارنة بالطرق الحالية مثل NSA وInfLLMv2.

Yuxiang Huang, Nuno M. T. Gonçalves, Federico Alvetreti, Lei Li, Xu Han, Edoardo M. Ponti, André F. T. Martins, Marcos V (…)2026-05-19
💬 NLP

Subgraph-level Universal Prompt Tuning

تقدم هذه الورقة البحثية "ضبط التلقين العالمي على مستوى المخطط الفرعي" (SUPT)، وهي طريقة متعددة الاستخدامات تقوم بتعيين سمات التلقين على مستوى المخطط الفرعي للتغلب على قيود السياق في أساليب ضبط تلقين المخططات الحالية، محققةً أداءً فائقاً على الضبط الدقيق في كل من سيناريوهات البيانات الكاملة والبيانات القليلة وبعدد أقل بكثير من المعلمات.

Junhyun Lee, Wooseong Yang, Jaewoo Kang2026-05-18