💬 NLP

Learned but Not Expressed: Capability-Expression Dissociation in Large Language Models

تُظهر هذه الدراسة التجريبية انفصالاً منهجياً في النماذج اللغوية الكبيرة، حيث يتم استرداد الحلول غير المسببة بنجاح تحت ظروف استخراج محددة، ومع ذلك تظل غائبة تماماً في سياقات التوليد القياسية، مما يتحدى الافتراض بأن وجود بيانات التدريب يتنبأ مباشرة باحتمالية المخرجات.

Toshiyuki Shigemura2026-03-20
💬 NLP

Beyond Accuracy: An Explainability-Driven Analysis of Harmful Content Detection

تحلل هذه الورقة نموذجاً للكشف عن المحتوى الضار قائماً على نموذج RoBERTa باستخدام تفسيرات شابل (Shapley Additive Explanations) والتدرجات المتكاملة (Integrated Gradients) لتكشف أنه في حين يحقق النظام دقة عالية، فإن طرق التفسير تُعد ضرورية لتشخيص الإخفاقات المنهجية في السيناريوهات السياقية والسياسية، مما يجعلها تعمل كأداة للشفافية لعمليات الإشراف التي تتضمن العنصر البشري بدلاً من كونها مجرد مقياس للأداء.

Trishita Dhara, Siddhesh Sheth2026-03-20
💬 NLP

MineDraft: A Framework for Batch Parallel Speculative Decoding

تقدم هذه الورقة MineDraft، وهو إطار عمل جديد لفك التشفير الاستباقي المتوازي على مستوى الدفعات، والذي يحسن بشكل كبير إنتاجية زمن انتقال استنتاج النماذج اللغوية الكبيرة (LLM) من خلال تداخل مرحلتي المسودة والتحقق، ويثبت جدواه العملية من خلال تنفيذ كإضافة برمجية (plugin) لمنصة vLLM.

Zhenwei Tang, Arun Verma, Zijian Zhou, Zhaoxuan Wu, Alok Prakash, Daniela Rus, Bryan Kian Hsiang Low2026-03-20
🤖 machine learning

Frayed RoPE and Long Inputs: A Geometric Perspective

تقدم هذه الورقة تحليلاً هندسياً يكشف أن تضمين الموضع الدوراني (RoPE) يؤدي إلى تدهور الأداء في المدخلات الطويلة عن طريق تعطيل فصل مجموعات المفتاح والاستعلام الضروري لوظيفة "رمز المصب" (sink token)، مما أدى إلى اقتراح RoPE-ID، وهو تعديل يطبق دورات عالية التردد على مجموعة فرعية من القنوات لتمكين التعميم الفعال للسياقات الممتدة.

Davis Wertheimer, Aozhong Zhang, Derrick Liu, Penghang Yin, Naigang Wang2026-03-20
💬 NLP

An Agentic System for Schema Aware NL2SQL Generation

تقترح هذه الورقة نظاماً وكيلياً (agentic system) مدركاً للمخطط (schema-aware) ومنخفض التكلفة لتوليد لغة طبيعية إلى استعلامات SQL (NL2SQL)، يعتمد بشكل أساسي على نماذج لغوية صغيرة مع آلية تراجع انتقائية إلى نماذج لغوية كبيرة، مما يحقق خفضاً كبيراً في التكاليف وأداءً قوياً على مقياس BIRD مع معالجة قيود الخصوصية والموارد.

David Onyango, Naseef Mansoor2026-03-20
💬 NLP

BenchBrowser -- Collecting Evidence for Evaluating Benchmark Validity

تُعد أداة BenchBrowser أداة استرجاع صُممت لمساعدة الممارسين على تقييم صلاحية المعايير المرجعية من خلال إظهار عناصر اختبار محددة ذات صلة بحالات استخدامهم، مما يساعد في تشخيص مشكلات مثل ضيق نطاق تغطية المحتوى وعدم استقرار التصنيفات لسد الفجوة بين الأهداف المنشودة والقياسات الفعلية للمعايير المرجعية.

Harshita Diddee, Gregory Yauney, Swabha Swayamdipta, Daphne Ippolito2026-03-20
💬 NLP

How Psychological Learning Paradigms Shaped and Constrained Artificial Intelligence

تجادل هذه الورقة بأن القيود التاريخية للذكاء الاصطناعي تنبع من وراثة القيود الهيكلية للنماذج النفسية للتعلم التي ألهمته، وتقترح إطار "ReSynth" ثلاثي الوحدات — الذي يدمج منظورًا عابرًا للثقافات حول التعلم بالتكرار — لفصل الاستدلال والغرض والمعرفة معمارياً كشرط ضروري لتحقيق الذكاء الاصطناعي العام.

Alex Anvi Eponon, Ildar Batyrshin, Christian E. Maldonado-Sifuentes, Grigori Sidorov2026-03-20
💬 NLP

Large-Scale Analysis of Political Propaganda on Moltbook

تستخدم هذه الدراسة مصنفات قائمة على معالجة اللغات الطبيعية لتحليل أكثر من 670,000 منشور على منصة الوكلاء الذكيين "مولتبوك" (Moltbook)، كاشفةً أن الدعاية السياسية تتركز بشكل كبير بين أقلية صغيرة من الوكلاء والمجتمعات، بينما تُظهر أدلة محدودة على التضخيم من خلال التعليقات.

Julia Jose, Meghna Manoj Nair, Rachel Greenstadt2026-03-20
💬 NLP

PowerFlow: Unlocking the Dual Nature of LLMs via Principled Distribution Matching

يقدم PowerFlow إطار عمل مبدئيًا للضبط الدقيق غير الخاضع للإشراف، يعيد صياغة تحسين النماذج اللغوية الكبيرة كمسألة مطابقة توزيعات باستخدام هدف توازن المسار المدرك للطول لاستثارة القدرات المزدوجة للاستدلال المنطقي والتعبير الإبداعي عبر استهداف توزيعات قدرة α\alpha القابلة للضبط، متفوقًا بذلك على الأساليب الحالية القائمة على الاستدلال وتجاوزاً للنماذج المرجعية الخاضعة للإشراف.

Ruishuo Chen, Yu Chen, Zhuoran Li, Longbo Huang2026-03-20
💬 NLP

From Topic to Transition Structure: Unsupervised Concept Discovery at Corpus Scale via Predictive Associative Memory

تقدم هذه الورقة طريقة تستخدم الذاكرة الترابطية التنبؤية لاكتشاف مفاهيم "بنية الانتقال" غير الخاضعة للإشراف وعلى نطاق المتون اللغوية، والتي تلتقط كيفية عمل النصوص وتطورها، مما يميزها عن النماذج التقليدية القائمة على التضمين التي تصنف النصوص حسب الموضوع الدلالي.

Jason Dury2026-03-20