💻 computer science

Form Without Function: Agent Social Behavior in the Moltbook Network

تحلل هذه الورقة شبكة "مولتبوك" (Moltbook)، وهي منصة اجتماعية تتكون بالكامل من وكلاء ذكاء اصطنا-عي، لتثبت أنه في حين أن بنيتها التحتية التقنية تعمل وتستجيب للتعليمات، إلا أن طبقتها الاجتماعية تفشل في البروز، مما يؤدي إلى نظام يكرر شكل وسائل التواصل الاجتماعي دون وظيفتها الجوهرية الشبيهة بالبشر.

Saber Zerhoudi, Kanishka Ghosh Dastidar, Felix Klement, Artur Romazanov, Andreas Einwiller, Dang H. Dang, Michael Dinzin (…)2026-04-16
💬 NLP

Caption First, VQA Second: Knowledge Density, Not Task Format, Drives Multimodal Scaling

تجادل هذه الورقة بأن العائق الأساسي في توسيع نطاق النماذج اللغوية الكبيرة متعددة الوسائط ليس تنوع تنسيق المهام، بل هو كثافة المعرفة في بيانات التدريب، حيث تُثبت أن إثراء التعليقات التوضيحية للصور بمعرفة مهيكلة يحقق تحسينات أكثر اتساقاً في الأداء من إضافة الإشراف الخاص بالمهام مثل الإجابة على الأسئلة البصرية.

Hongjian Zou, Yue Ge, Qi Ding, Yixuan Liao, Xiaoxin Chen2026-04-16
💬 NLP

A Multi-Model Approach to English-Bangla Sentiment Classification of Government Mobile Banking App Reviews

تحلل هذه الدراسة 5,652 مراجعة باللغتين الإنجليزية والبنغالية لتطبيقات الخدمات المصرفية عبر الهاتف المحمول التابعة للحكومة البنغلاديشية الأربعة باستخدام نهج تسمية هجين ونماذج متعددة، كاشفةً أن خوارزميات التعلم الآلي التقليدية تفوقت على النماذج القائمة على المحولات في تصنيف المشاعر مع تحديد سرعة المعاملات وتصميم الواجهة كنقاط ضعف رئيسية للمستخدمين، وتسليط الضوء على فجوة أداء كبيرة بين معالجة اللغتين الإنجليزية والبنغالية.

Md. Naim Molla, Md Muhtasim Munif Fahim, Md. Binyamin, Md Jahid Hasan Imran, Tonmoy Shil, Nura Rayhan, Md Rezaul Karim2026-04-16
💬 NLP

KMMMU: Evaluation of Massive Multi-discipline Multimodal Understanding in Korean Language and Context

تقدم هذه الورقة KMMMU، وهو معيار مرجعي شامل للغة الكورية الأصلية يتكون من 3,466 سؤالاً امتحانياً متعدد الوسائط عبر تسعة تخصصات، يكشف عن فجوات كبيرة في الأداء في نماذج الذكاء الاصطناعي الحالية نتيجة التحديات في فهم الاصطلاحات والمعايير المحلية والمعرفة الخاصة بكل مجال بدلاً من عمق الاستنتاج.

Nahyun Lee, Guijin Son, Hyunwoo Ko, Chanyoung Kim, JunYoung An, Kyubeen Han, Il-Youp Kwak2026-04-16
💬 NLP

Red Skills or Blue Skills? A Dive Into Skills Published on ClawHub

تقدم هذه الورقة دراسة تجريبية لـ ClawHub، وهو سجل عام ضخم يضم 26,502 من مهارات وكلاء النماذج اللغوية الكبيرة (LLM)، حيث تكشف عن اختلافات وظيفية متميزة عبر اللغات بين المهارات الإنجليزية والصينية، وتسلط الضوء على مخاطر أمنية جسيمة مع تصنيف أكثر من 30% من المهارات كمهارات مشبوهة، بينما تثبت أيضاً جدوى التنبؤ المبكر بالمخاطر باستخدام إشارات وقت التقديم.

Haichuan Hu, Ye Shang, Quanjun Zhang2026-04-16
💬 NLP

Lossless Prompt Compression via Dictionary-Encoding and In-Context Learning: Enabling Cost-Effective LLM Analysis of Repetitive Data

تقدم هذه الورقة طريقة لضغط المطالبات (prompt compression) غير معتمدة على التدريب وغير فاقدة للمعلومات، تُمكّن النماذج اللغوية الكبيرة من إجراء التعلم في السياق (in-context learning) على البيانات المتكررة المرمزة بقواميس (dictionary-encoded)، محققةً ضغطاً يصل إلى 80% مع الحفاظ على الدقة التحليلية وتقليل تكاليف واجهة برمجة التطبيقات (API) وحدود الرموز (tokens) بشكل كبير.

Andresa Rodrigues de Campos, David Lee, Imry Kissos, Piyush Paritosh2026-04-16
💬 NLP

Before the First Token: Scale-Dependent Emergence of Hallucination Signals in Autoregressive Language Models

تكشف هذه الدراسة أن النماذج اللغوية ذات الانحدار الذاتي تظهر انتقالاً طورياً يعتمد على الحجم في اكتشاف الهلوسة، حيث لا تطور إلا النماذج التي تتجاوز حوالي مليار معلمة وتدربت باستخدام الضبط الدقيق للتعليمات إشارة داخلية ذات دلالة إحصائية تشير إلى القصد الواقعي قبل توليد أي رموز، في حين أن الحجم المجرد وحده غير كافٍ لهذا الترميز المسبق للالتزام.

Dip Roy, Rajiv Misra, Sanjay Kumar Singh, Anisha Roy2026-04-16
💬 NLP

Curation of a Palaeohispanic Dataset for Machine Learning

تتناول هذه الورقة ندرة الموارد المناسبة لدراسة لغات شبه الجزيرة الإيبيرية القديمة (Palaeohispanic) من خلال بناء مجموعة بيانات مهيكلة مصممة خصيصاً لتمكين تطبيق تقنيات تعلم الآلة في هذا المجال الذي لم ينل حقه من البحث.

Gonzalo Martínez-Fernández, Jose F Quesada, Agustín Riscos-Núñez, Francisco José Salguero-Lamillar2026-04-16
💬 NLP

EVE: A Domain-Specific LLM Framework for Earth Intelligence

تقدم هذه الورقة البحثية EVE، وهو أول إطار عمل مفتوح المصدر وشامل (end-to-end) لاستخبارات الأرض، والذي يتميز بنموذج EVE-Instruct 24B المتكيف مع المجال، ومعايير تقييم شاملة، ونظام جاهز للإنتاج يدمج تقنيات التوليد المعزز بالاسترداد (RAG) وكشف الهلوسة، مع إتاحة جميع الموارد للمجتمع.

Àlex R. Atrio, Antonio Lopez, Jino Rohit, Yassine El Ouahidi, Marcello Politi, Vijayasri Iyer, Umar Jamil, Sébastien Bra (…)2026-04-16
💬 NLP

OmniTrace: A Unified Framework for Generation-Time Attribution in Omni-Modal LLMs

يُعد OmniTrace إطار عمل خفيف الوزن ومستقل عن النماذج يعالج تحدي عزو العبارات المولدة في النماذج اللغوية الكبيرة متعددة الوسائط من خلال صياغة العزو كمسألة تتبع أثناء التوليد، مما يتيح تفسيرات متماسكة على مستوى النطاق عبر الوسائط دون الحاجة إلى إعادة تدريب أو إشراف.

Qianqi Yan, Yichen Guo, Ching-Chen Kuo, Shan Jiang, Hang Yin, Yang Zhao, Xin Eric Wang2026-04-16