💬 NLP

Whitening Reveals Cluster Commitment as the Geometric Separator of Hallucination Types

تُثبت هذه الورقة أن تطبيق تبييض تحليل المكونات الرئيسية (PCA-whitening) على تضمينات نموذج GPT-2-small يكشف عن الالتزام العنقودي (cluster commitment) كفاصل هندسي يميز أنواع الهلوسة، وتحديداً من خلال حل مشكلة عدم التمييز السابقة بين فشلي "التقارب نحو البئر الخاطئ" (wrong-well convergence) و"فجوة التغطية" (coverage gap)، مع تحديد عدم القدرة على الفصل بين "انحراف المركز" (center-drift) و"التقارب نحو البئر الخاطئ" كقصور في قدرة النموذج وليس كأثر ناتج عن عملية القياس.

Matic Korun2026-03-10
💬 NLP

ArcLight: A Lightweight LLM Inference Architecture for Many-Core CPUs

تُعد ArcLight بنية تحتية خفيفة الوزن لاستنتاج النماذج اللغوية الكبيرة (LLM) مصممة خصيصاً للمعالجات متعددة الأنوية، حيث تتغلب على اختناقات الوصول إلى الذاكرة عبر تقنية NUMA من خلال الإدارة الفعالة للذاكرة، وجدولة الخيوط، والتوازي المنسق للموترات، محققةً إنتاجية أعلى بنسبة تصل إلى 46% مقارنة بالأطر البرمجية السائدة مع الحفاظ على توافق واسع مع مختلف الأجهزة.

Yuzhuang Xu, Xu Han, Yuxuan Li, Wanxiang Che2026-03-10
💬 NLP

Dual-Metric Evaluation of Social Bias in Large Language Models: Evidence from an Underrepresented Nepali Cultural Context

تقيم هذه الدراسة سبعة نماذج لغوية كبيرة متطورة في السياق الثقافي النيبالي غير الممثل كفاية باستخدام إطار تقييم التحيز ثنائي المعايير، كاشفةً أنه بينما يمكن قياس الموافقة الصريحة على العبارات المتحيزة، فإن التحيز التوليدي الضمني يظل متميزاً، ويتبع علاقة غير خطية مع درجة الحرارة، ولا يمكن التنبؤ به بدقة عبر مقاييس الموافقة، مما يسلط الضيز على الحاجة الماسة لمجموعات بيانات واستراتيجيات تقييم قائمة على أسس ثقافية.

Ashish Pandey, Tek Raj Chhetri2026-03-10
💬 NLP

DistillGuard: Evaluating Defenses Against LLM Knowledge Distillation

تقدم الورقة البحثية إطار عمل DistillGuard، الذي يقيم بشكل منهجي دفاعات مستوى المخرجات ضد تقطير المعرفة في النماذج اللغوية الكبيرة (LLM)، ويجد أن معظم النهج الحالية غير فعالة إلى حد كبير، حيث يعتمد تدهور الأداء بشكل كبير على المهمة ويكون غير كافٍ لمنع سرقة المعرفة على نطاق واسع.

Bo Jiang2026-03-10
💬 NLP

AI Steerability 360: A Toolkit for Steering Large Language Models

تقدم الورقة البحثية AI Steerability 360، وهي مجموعة أدوات برمجية مفتوحة المصدر بلغة بايثون ومتوافقة أصلياً مع Hugging Face، توفر واجهة موحدة لتركيب وتقييم ومقارنة طرق توجيه النماذج اللغوية الكبيرة المتنوعة عبر أسطح التحكم في المدخلات، والهيكل، والحالة، والمخرجات.

Erik Miehling, Karthikeyan Natesan Ramamurthy, Praveen Venkateswaran, Irene Ko, Pierre Dognin, Moninder Singh, Tejaswini (…)2026-03-10
💬 NLP

An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data

تقدم هذه الورقة FusionSQL، وهو مُقيّم مبتكر يقدر دقة نماذج Text2SQL على مجموعات بيانات غير مرئية وغير مصنفة من خلال تحليل أنماط المخرجات للكشف عن تحولات الأداء دون الحاجة إلى تسميات مرجعية.

Trinh Pham, Thanh Tam Nguyen, Viet Huynh, Hongzhi Yin, Quoc Viet Hung Nguyen2026-03-10
💬 NLP

SynPlanResearch-R1: Encouraging Tool Exploration for Deep Research with Synthetic Plans

تقدم الورقة البحثية SynPlanResearch-R1، وهو إطار عمل يعمل على توليف مسارات استخدام الأدوات لتشجيع الاستكشاف الأعمق أثناء الضبط الدقيق الخاضع للإشراف، مما يتغلب على قيود التعلم المعزز بالمكافآت القابلة للتحقق ويحسن بشكل كبير أداء وكلاء البحث عبر عدة معايير مرجعية.

Hansi Zeng, Zoey Li, Yifan Gao, Chenwei Zhang, Xiaoman Pan, Tao Yang, Fengran Mo, Jiacheng Lin, Xian Li, Jingbo Shang2026-03-10
💬 NLP

What Do AI Agents Talk About? Emergent Communication Structure in the First AI-Only Social Network

تحلل هذه الورقة الخطاب الناشئ لـ "مولتبوك" (Moltbook)، أول شبكة اجتماعية مقتصرة على الذكاء الاصطناعي، كاشفةً أن مجتمعات الوكلاء فيها تتميز بالتأمل الذاتي غير المتناسب، والإشارات الطقسية، وإعادة التوجيه العاطفي بدلاً من التوافق الوجداني.

Taksch Dube, Jianfeng Zhu, NHatHai Phan, Ruoming Jin2026-03-10
💬 NLP

BRIDGE: Benchmark for multi-hop Reasoning In long multimodal Documents with Grounded Evidence

تقدم الورقة البحثية BRIDGE، وهو معيار مرجعي جديد مصمم لتقييم الاستدلال متعدد الخطوات في الوثائق العلمية متعددة الوسائط الطويلة من خلال توفير تعليقات توضيحية على مستوى الخطوات تكشف عن أوجه قصور منهجية في تجميع الأدلة والربط بالحقائق والتي أغفلتها التقييمات التقليدية التي تقتصر على الإجابة فقط.

Biao Xiang, Soyeon Caren Han, Yihao Ding2026-03-10
💬 NLP

Examining the Role of YouTube Production and Consumption Dynamics on the Formation of Extreme Ideologies

تقدم هذه الورقة دراسة طولية قائمة على أساليب مختلطة شملت 1,100 مشارك من الولايات المتحدة، تُظهر أن التحولات نحو الأيديولوجيات المتطرفة مدفوعة بديناميكية تبادلية حيث يستهلك المستخدمون محتوى من قنوات تنتج بشكل متزايد مواد مثقلة بالغضب والمظلومية، والتي بدورها تزيد من حدة الاستقطاب الأيديولوجي.

Sarmad Chandio, Rishab Nithyanand2026-03-10