💻 computer science

Digital Harf: A Clinically Integrated Multimodal AI System for Pervasive Arabic Speech and Language Therapy

تقدم هذه الورقة "Digital Harf"، وهو نظام ذكاء اصطناعي متعدد الوسائط متكامل سريرياً يعالج نقص موارد علاج النطق باللغة العربية عبر استخدام محرك بيانات اصطناعية وكيلي (Agentic Synthetic Data Engine) لتوليد محتوى علاجي متجذر ثقافياً بشكل تلقائي، مما يحقق قبولاً سريرياً عالياً ويمكّن من العلاج المنزلي الفعال للأطفال المصابين باضطراب طيف التوحد في الدول الناطقة باللغة العربية.

Asif Azad, Mohammad Sadat Hossain, MD Sadik Hossain Shanto, Sabri Boughorbel, Abdulrhman Aljouie, Bdour Alwuqaysi, Yahya (…)2026-07-31
💬 NLP

AI-assisted pre-review of open-source software submissions: an experience report from BOSC 2026

يفصل تقرير الخبرة هذا من مؤتمر BOSC 2026 تطوير وتقييم نظام مراجعة مسبقة مدعوم بالذكاء الاصطناعي، والذي استخدم مهارات وكيلة واختبارات حاوية مؤتمتة لدعم المراجعين البشريين في تقييم تقديمات البرمجيات مفتوحة المصدر، كاشفاً أنه بينما وجد المراجعون الأداة مفيدة، إلا أنهم فضلوا التحقق من نتائجها بدلاً من الاعتماد عليها دون تشكيك.

Tazro Ohta, Nomi L. Harris, Seth Carbon2026-07-31
🤖 machine learning

THGFM: Dual-Branch Temporal Heterogeneous Graph Fusion Model

تقترح الورقة البحثية نموذج THGFM، وهو نموذج دمج للرسوم البيانية الزمنية غير المتجانسة ثنائي المسار يوحد بين النقل عبر الأنواع الموفر للمعلمات والتخصص المدرك للعلاقات من خلال آلية دمج بوابية مبتكرة وانتباه زمني دوراني، محققاً أداءً هو الأفضل في فئته على العديد من معايير الرسوم البيانية الأكاديمية وذات النطاق الواسع على الويب.

Yixin Peng, Diego Collarana, Er Jin, Stefan Decker2026-07-31
💬 NLP

LayerRAG-Bench: A Cross-Layer Reliability Benchmark for Agentic Retrieval-Augmented Generation

تقدم هذه الورقة LayerRAG-Bench، وهو معيار مرجعي شامل يوضح أنه في حين أن تطبيع المخطط (schema normalization) يعالج بفعالية انحراف المخطط (schema drift) في أنظمة RAG الوكيلية، إلا أنه يفشل في حل مشكلات موثوقية حرجة أخرى مثل الأدلة القديمة أو أخطاء الأذونات، مما يدعو إلى تقييم مستهدف خاص بكل طبقة بدلاً من الاعتماد على الإصلاحات الشاملة أو مقاييس التجذر (groundedness) فقط.

Musa Shams (Independent Researcher)2026-07-31
🤖 machine learning

Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation

تقدم هذه الورقة البحثية "النمذجة الاستكشافية"، وهي نموذج جديد يعمل على تحليل حلقة التدريب لاستكشاف مرشحات توليد متعددة واختيار الأفضل بينها، مما يجعل الاستكشاف محوراً ثالثاً قابلاً للتوسع في مرحلة ما قبل التدريب يحسن الكفاءة والأداء عبر المجالات مع تمكين النمذجة التوليدية الحقيقية من طرف إلى طرف.

Alexi Gladstone, Heng Ji, Yilun Du2026-07-31
💬 NLP

Same Facts, Different Diagnosis: Measuring and Mitigating Narrative Anchoring in Clinical Language Models

تحدد هذه الورقة "الارتكاز السردي"، وهو انحياز حيث تنتج النماذج اللغوية السريرية تشخيصات متباينة لحقائق متطابقة بناءً فقط على السجل اللغوي الاجتماعي، وتقترح "NarrativeShield"، وهو مسار مكون من ثلاثة وكلاء يستخرج الحقائق ويتحقق منها هيكلياً للقضاء تقريباً على هذه الفجوة مع الحفاظ على الاستقرار التشخيصي.

Prabhjot Singh, Pritam Deka, Vijay Chennareddy2026-07-31
💬 NLP

AHA-Memes: A Fine-Grained Multimodal Benchmark for Understanding Hate in Arabic Memes

تقدم هذه الورقة AHA-Memes، وهو أول معيار لتقييم الميمات العربية التي تحتوي على كراهية على نطاق واسع ودقيق، ويضم 5,000 مثال مشروح يدويًا و66,000 ميم من الملصقات الفضية، إلى جانب تقييمات شاملة لمختلف النماذج متعددة الوسائط لمعالجة التحديات غير المستكشفة في اكتشاف الكراهية المتجذرة ثقافيًا في المحتوى العربي عبر الإنترنت.

Mohamed Bayan Kmainasi, Ali Ezzat Shahroor, Abul Hasnat, Md. Rafiul Biswas, Wajdi Zaghouani, Firoj Alam2026-07-31
💬 NLP

Dimensionality and Measurement Precision in HLE's Multiple-Choice Subset

تستخدم هذه الورقة التحليل السيكومتري لتوضيح أن "امتحان البشرية الأخير" (HLE) يقيس في المقام الأول عامل استدلال عام واحد بدلاً من قدرات متميزة خاصة بمجالات محددة، وأن دقة قياسه غير كافية للتمييز بفعالية بين النماذج اللغوية الرائدة.

Mayank Sharma, Savira Nadela, Tyler Matteson2026-07-31
🤖 machine learning

Latent States in Neural Networks: Recovering the Temporal Structure of Drifting Data from Model Weights

تُثبت هذه الورقة أن ملاءمة نموذج ماركوف الخفي للأوزان المرتبة زمنياً للمصنفات المدربة على تدفقات بيانات متغيرة يمكن أن يستعيد الأنظمة الزمنية الكامنة التي تتنبأ بأداء التعميم بشكل أكثر فعالية من التقارب الزمني البسيط أو التقسيمات الساذجة، مما يكشف أن أوزان النموذج تشفر تحولات هيكلية ذات معنى في توزيع البيانات الأساسي.

Kevin Guan2026-07-31
💬 NLP

Belief Coevolution in a Social Network of Generalist and Specialist Large Language Models

تقدم هذه الورقة إطار عمل CoevolveSim لتوضيح أنه في حين أن الأدوار الاجتماعية وهياكل الشبكات لها تأثير محدود على الإجماع على مستوى السكان، فإن إدراج نماذج لغوية كبيرة متخصصة يعزز بشكل كبير تحولات المعتقدات ويخلق تأثيراً غير متماثل، مما يشير إلى أن عمليات المحاكاة متعددة الوكلاء الواقعية تتطلب تنوعاً في النماذج بدلاً من مجرد التوجيه عبر تقمص الشخصيات.

Germans Savcisens, Samantha Dies, Courtney Maynard, Tina Eliassi-Rad2026-07-31