💬 NLP

ConfSpec: Efficient Step-Level Speculative Reasoning via Confidence-Gated Verification

يقدم ConfSpec إطار عمل للتحقق المتتالي المعتمد على بوابات الثقة، والذي يستفيد من عدم التماثل بين التوليد والتحقق لحل المفاضلة بين الدقة والسرعة في الاستدلال الاستباقي على مستوى الخطوة، محققاً تسريعاً في الأداء النهائي يصل إلى 2.24 ضعفاً دون المساس بدقة النموذج المستهدف أو اشتراط نماذج حكم خارجية.

Siran Liu, Cyril Y. He2026-02-24
💬 NLP

Asymptotic Semantic Collapse in Hierarchical Optimization

تقترح هذه الورقة إطاراً نظرياً لـ "الانهيار الدلالي التقاربي"، موضحاً كيف تتقارب الأنظمة متعددة الوكلاء الهرمية نحو حالة دلالية موحدة على متشعب ريماني بغض النظر عن تاريخ التحديث، مع التحقق تجريبياً من هذه الديناميكيات من خلال اختبار معياري خالٍ من البيانات على نموذج RWKV-7.

Faruk Alpay, Bugra Kilictas2026-02-24
💬 NLP

Exploring the Ethical Concerns in User Reviews of Mental Health Apps using Topic Modeling and Sentiment Analysis

تستخدم هذه الدراسة إطار عمل لمعالجة اللغات الطبيعية يجمع بين نمذجة المواضيع، والتصنيف صفري المعرفة، وتحليل المشاعر على مراجعات متاجر التطبيقات لتحديد المخاوف الأخلاقية القائمة والناشئة في تطبيقات الصحة النفسية المدعومة بالذكاء الاصطناعي، بهدف اقتراح نظام لتعزيز عدالتها وشفافيتها وموثوقيتها.

Mohammad Masudur Rahman, Beenish Moalla Chaudhry2026-02-24
💬 NLP

The Algorithmic Unconscious: Structural Mechanisms and Implicit Biases in Large Language Models

تقدم هذه الورقة مفهوم "اللاوعي الخوارزمي" لتجادل بأن التحيزات الكبيرة في النماذج اللغوية الكبيرة لا تنشأ مجرد من تكوين مجموعات البيانات، بل من آليات هيكلية متأصلة مثل التجزئة (tokenization)، والانتباه (attention)، والمحاذاة (alignment)، مبرهنةً من خلال التحليل التجريبي لفرط التجزئة في اللغة العربية كيف تعمل هذه العوامل البنيوية على تشويه أداء النموذج بشكل منهجي وتستوجب إطاراً جديداً للتدقيق التقني.

Philippe Boisnard2026-02-24
💬 NLP

Red Teaming LLMs as Socio-Technical Practice: From Exploration and Data Creation to Evaluation

بالاستناد إلى مقابلات مع ٢٢ ممارساً، تنتقد هذه الورقة التركيز التقني الحالي لعمليات "الفريق الأحمر" (red teaming) لنماذج اللغات الكبيرة من خلال فحص الممارسات الاجتماعية-التقنية لإنشاء مجموعات البيانات وتقييمها، كاشفةً كيف يغفل تصور المخاطر غالباً عن السياق وخصوصية المستخدم، مع اقتراح اتجاهات جديدة لأبحاث التفاعل بين الإنسان والحاسوب (HCI).

Adriana Alvarado Garcia, Ruyuan Wan, Ozioma C. Oguine, Karla Badillo-Urquiola2026-02-24
💬 NLP

The Million-Label NER: Breaking Scale Barriers with GLiNER bi-encoder

تقدم هذه الورقة البحثية GLiNER-bi-Encoder، وهي بنية مشفر ثنائي (bi-encoder) مبتكرة تتغلب على التعقيد التربيعي لنماذج التعرف على الكيانات المسماة (NER) التقليدية لتمكين التعرف صفرِي القدرة (zero-shot) عالي الكفاءة والتميز على ملايين أنواع الكيانات، إلى جانب إطار عمل GLiNKER للربط عالي الأداء للكيانات.

Ihor Stepanov, Mykhailo Shtopko, Dmytro Vodianytskyi, Oleksandr Lukashov2026-02-24
💬 NLP

Hierarchical Reward Design from Language: Enhancing Alignment of Agent Behavior with Human Specifications

تقدم هذه الورقة البحثية تصميم المكافأة الهرمي من اللغة (HRDL) وحله، "من اللغة إلى المكافآت الهرمية" (L2HR)، لترجمة المواصفات البشرية الدقيقة إلى دالات مكافأة هرمية تضمن مواءمة سلوك وكيل الذكاء الاصطناعي بشكل أفضل مع التوقعات البشرية في المهام المعقدة طويلة المدى.

Zhiqin Qian, Ryan Diaz, Sangwon Seo, Vaibhav Unhelkar2026-02-24
💬 NLP

DP-RFT: Learning to Generate Synthetic Text via Differentially Private Reinforcement Fine-Tuning

تقدم هذه الورقة DP-RFT، وهو إطار عمل للتعلم التعزيزي بخصوصية تفاضلية يُمكّن النماذج اللغوية الكبيرة من توليد بيانات اصطناعية عالية الدقة عبر التحسين التكراري مقابل أصوات الجار الأقرب التي تحافظ على الخصوصية من مجموعة بيانات خاصة، مما يحقق فائدة قوية دون الحاجة إلى الوصول المباشر إلى الأمثلة الخاصة الفردية.

Fangyuan Xu, Sihao Chen, Zinan Lin, Taiwei Shi, Sydney Graham, Pei Zhou, Mengting Wan, Alex Stein, Virginia Estellers, C (…)2026-02-24
💬 NLP

Contradiction to Consensus: Dual Perspective, Multi Source Retrieval Based Claim Verification with Source Level Disagreement using LLM

تقترح هذه الورقة نظاماً جديداً للتحقق من الادعاءات في النطاق المفتوح يستفيد من النماذج اللغوية الكبيرة والاسترجاع متعدد المصادر لتجميع الأدلة من وجهات نظر متنوعة، بما في ذلك المعلومات المتناقضة، مما يعزز دقة التحقق والشفافية والقابلية للتفسير مقارنة بالنهج التقليدي أحادي المصدر.

Md Badsha Biswas, Ozlem Uzuner2026-02-24
💬 NLP

Semantic Substrate Theory: An Operator-Theoretic Framework for Geometric Semantic Drift

تقترح هذه الورقة إطاراً نظرياً عملياتياً يُسمى "نظرية الركيزة الدلالية" (Semantic Substrate Theory) يوحد إشارات الانزياح الدلالي المتباينة في نموذج هندسي واحد مرتبط زمنياً، مُقدمةً مفاهيم مثل "الكتلة الجسرية" و"الانزياح التكراري" للتنبؤ بإعادة صياغة الجوار مع تأجيل التحقق التجريبي إلى دراسات مستقبلية.

Stephen Russell2026-02-24