🤖 AI

Redteaming Leading Arabic LLMs with ASAS

تقدم هذه الورقة ASAS، وهو أول معيار مرجعي للغة العربية مُعدّ بالكامل من قبل بشر لاختبار متانة النماذج اللغوية الكبيرة (redteaming)، والذي يكشف عن فجوات أمان كبيرة في النماذج الرائدة ضد الهجمات العدائية المتنوعة، ويسلط الضالط على محدودية التقييم الآلي للسلامة مقارنة بالتقدير البشري.

Fidaa Abed, Haidar Khan, M Saiful Bari, Babar Khan, Abdalghani Abujabal2026-08-25
🤖 AI

SPAR-Hate: An Auditor-Guided Multi-Agent Framework for Bilingual Hate Speech Parsing

تقدم هذه الورقة SPAR-Hate، وهو إطار عمل متعدد الوكلاء بتوجيه من مدقق لتحسين تحليل خطاب الكراهية ثنائي اللغة عن طريق تفكيك المستندات إلى وحدات على مستوى الجملة، وتوليد أحكام قائمة على الأدلة من منظور الضحية، والمراقب، والشاهد الثقافي، وحل النزاعات من خلال التحكيم لتحقيق نتائج رائدة في معايير الاستخراج المهيكل.

Yifan Lyu, Dianqing Lin, Xinran Li, Jiaqi Qiao, Xiujuan Xu2026-08-25
🤖 AI

Multi-Agent Discovery and Resource-Aware Autonomous Exploration of Scientific Datasets

تقدم هذه الورقة WebVisus، وهو نظام متعدد الوكلاء مراعٍ للموارد يستكشف ذاتياً مجموعات البيانات العلمية عن بُعد ومتعددة الدقة استجابةً لاستعلامات باللغة الطبيعية عبر تكييف استرجاع البيانات وتصورها ديناميكياً مع القيود الحسابية المتاحة.

Aashish Panta, Hugo Lee, Giorgio Scorzelli, Kyongsik Yun, Valerio Pascucci2026-08-25
🤖 AI

More Accurate or More Efficient? Evaluating Locally Deployed Compact Open-Weight Language Models for Mathematical Reasoning

تقدم هذه الورقة إطار تقييم منضبط لنماذج اللغة المفتوحة الأوزان والمدمجة والمنشورة محلياً في مجال الاستدلال الرياضي، مما يثبت أن الدقة وحدها غير كافية لاختيار النماذج عبر الكشف عن مقايضات جوهرية حيث يوفر نموذج Gemma3:4b كفاءة فائقة في استهلاك الطاقة رغم تفوق دقة نموذج Qwen3:4b في مجموعات بيانات محددة.

Orion Powers, Daniella Seum, Khaled Slhoub2026-08-25
⚡ electrical engineering

CRS-Bench: A Reference-Relative Reliability Benchmark for Medical Image Encoders

تقدم الورقة البحثية CRS-Bench، وهو معيار مرجعي شامل يقيم 15 مشفرًا للصور الطبية عبر تخصصات الأمراض الجلدية وطب العيون والأشعة باستخدام أربعة أبعاد للموثوقية لاستخلاص درجة الموثوقية السريرية (CRS)، مما يثبت أن تقييم الموثوقية متعدد المحاور غالبًا ما يسفر عن ترتيبات مختلفة للنماذج مقارنة بالاختيار التقليدي القائم على AUROC.

Xingtao Lin, Hangqi Ren, Caiwan Sun, You Chen2026-08-25
🤖 AI

Search Broadly, Seek Evidence on Both Sides, Decide Narrowly: Evidence-Admissible GraphRAG for Longitudinal Clinical Event Verification

تقدم هذه الورقة MedEventGraph-RAG، وهو إطار عمل مقبول كدليل يتحقق من علاقات الأحداث السريرية الطولية عبر بناء رسوم بيانية خاصة بكل مريض للبحث على نطاق واسع وربط سلاسل الأحداث المرشحة مع الأدلة المصدرية من الجانبين المؤيد والمعارض، محققاً في النهاية دقة وقابلية تتبع فائقتين عبر مجموعات بيانات سريرية متعددة مقارنة بالنماذج المرجعية الحالية.

Xingtao Lin, Yubo Feng, Weixin Liu, Hangqi Ren, Junchao Zhou, Caiwan Sun, You Chen2026-08-25
🤖 AI

From SQL Generation to Tool Selection: A Domain-Oriented Pattern for MCP Servers

تقدم هذه الورقة نمط الأدوات الموجهة نحو النطاق (Domain-Oriented Tooling Pattern) وتطبيقه مفتوح المصدر، MCP Blueprint، الذي يستبدل توليد لغة SQL العام باختيار أدوات محددة لنطاق العمل لتحسين الدقة بشكل كبير وتقليل التكاليف للنماذج اللغوية الكبيرة الأصغر حجماً في سيناريوهات الوصول إلى البيانات المؤسسية.

Bartolomeo Bogliolo2026-08-25
🤖 machine learning

ADMIL: Attention-Distilled Multiple Instance Learning for Selective Foundation Model Inference in Pathology

تقدم الورقة البحثية ADMIL، وهو إطار عمل للحوسبة الانتقائية يقوم بتقطير انتباه نموذج معلم يعتمد على التعلم متعدد الأمثلة القائم على الانتباه إلى نموذج PriorNet خفيف الوزن لاختيار البلاطات الأكثر إفادة فقط لاستنتاج النموذج التأسيسي المكلف، مما يحقق أداء المعلم الكامل مع تقليل التكاليف الحسابية بنسبة تزيد عن 98% في تحليل شرائح علم الأمراض.

Duncan Stothers, Ren-Chin Wu, William Lotter2026-08-25
🤖 AI

Dissecting Neuro-Symbolic Quality Assurance for Synthetic Oncology Data Generation

تُظهر هذه الدراسة أنه في حين أن ضمان الجودة القائم على الرموز العصبية (neuro-symbolic)، ولا سيما التحقق من صحة المخطط (schema validation)، يُعد أمراً ضرورياً للقضاء على بيانات الأورام الاصطناعية غير الصالحة سريرياً، إلا أن فعاليته تتباين بشكل كبير باختلاف النموذج واستراتيجية الاسترجاع، مما يكشف أن البوابة الرمزية (symbolic gating) تضمن صلاحية المتن دون أن تؤدي بالضرورة إلى تحسين ثراء المفردات أو الأداء على الملاحظات السريرية الواقعية.

Laxmigayathri Challa, Yuhan Zhou, Ana Cleveland, Haihua Chen2026-08-25
🤖 AI

Learning Implicit Constitutive Laws for Dynamic 3D Gaussian Splatting from Monocular Videos

تقدم الورقة البحثية GCA (المحاذاة التكوينية الغاوسية)، وهو إطار عمل يتعلم القوانين التكوينية الضمنية لتقنية Gaussian Splatting ثلاثية الأبعاد الديناميكية من فيديوهات أحادية العدسة عبر الجمع بين التكيف القائم على LoRA ومرتكزات هندسية-عمقية قائمة على الرتبة، ومنظم أولوية تكوينية للتغلب على قيود الطرق الحالية في التفسير الفيزيائي والاستقرار أحادي العدسة.

Xiaoyang Liu, Kai Han2026-08-25