🤖 AI

Mixture-of-Expert Blocks Contain Strong Hallucination Detection Signals

تقدم هذه الورقة البحثية InnerExpert، وهي طريقة مبتكرة للكشف عن الهلوسة على مستوى الرمز (per-token) تستفيد من الإشارات الداخلية الفريدة لبنيات خليط الخبراء (MoE) — مثل إنتروبيا الموجه (router entropy) وعدم توافق الخبراء (expert disagreement) — لتحقيق أداء فائق عبر مجموعات بيانات متعددة مع تطلب تمريرة أمامية واحدة فقط.

Joao Fonseca, Rodrigo Rodrigues, Paolo Romano2026-08-19
🤖 AI

GADR: Gathering Architecture Decision Records from Meeting Transcriptions

تقدم هذه الورقة البحثية GADR، وهو سير عمل متعدد الوكلاء وذاتي التصحيح يستخرج بفعالية القرارات المعمارية من نصوص الاجتماعات الخام والمشوشة لإنشاء سجلات قرارات معمارية (ADRs) مهيكلة بتنسيق Nygard، مما يظهر استقرارًا وفائدة متفوقين مقارنة بالنماذج المرجعية القائمة على نموذج لغوي كبير أحادي التمرير، مع تسليط الضوء على المقايضات الحرجة بين عمق الإثراء القائم على استرجاع المعلومات المعزز (RAG) وبين الأمانة في نقل محتوى النص.

Lucas Daniel Costa da Silva, Kiev Gama2026-08-19
🤖 AI

Accuracy and Robustness of Model Cascades Under Data Perturbations

تقيم هذه الورقة مدى متانة تسلسلات النماذج الموفرة للطاقة تحت تأثير اضطرابات البيانات، حيث تحدد ثلاثة أنماط فشل متميزة تؤدي فيها تدهورات المدخلات إلى تقويض موثوقية التوجيه، وتوضح أن مثل هذه الأنظمة تتطلب تقييماً يتجاوز الدقة في الظروف المثالية لضمان الأداء في ظل تغيرات التوزيع.

Pallavi Mitra, Jai Kushwaha, Felix Biessmann2026-08-19
🤖 AI

Neuro-symbolic learning over OWL 2 DL via consequence-based compilation to differentiable circuits

تقدم هذه الورقة Baobab، وهو إطار عمل للتعلم العصبي الرمزي يقوم بتجميع أنطولوجيات OWL 2 DL كاملة في مخططات قرار جملية قابلة للتفاضل لتدريب شبكات الإدراك تحت إشراف جزئي، مما يتغلب بفعالية على اختصارات الاستدلال ويحقق أداءً أمثلياً بايزياً في مهام المنطق الوصفي غير الهورني (non-Horn).

Olga Mashkova, Asaad Mohammedsaleh, Fernando Zhapa-Camacho, Robert Hoehndorf2026-08-19
🤖 AI

The Curious Case of Exploding DecPOMDPs: Containing the Fire through Policy Counting

تتناول هذه الورقة التعقيد الأسي لعمليات ماركوف لاتخاذ القرار الموزعة ذات الإدراك الجزئي (DecPOMDPs) من خلال الانتقال من عدّ الوكلاء إلى عدّ السياسات، مما يتيح حلولاً قابلة للتنفيذ عبر نهج برمجة ديناميكية جديد يعتمد على عدّ السياسات ويستفيد من التماثل للوصول إلى تمثيل مدمج.

Nazlı Nur Karabulut, tanya Braun2026-08-19
🤖 AI

D2^2ACCI: A Dual-Loop Diagnostic Protocol for Evidence-Preserving Agent Memory

تقدم هذه الورقة D2^2ACCI، وهو بروتوكول تشخيصي ثنائي الحلقة يعزز موثوقية أنظمة ذاكرة وكلاء النماذج اللغوية الكبيرة (LLM) من خلال تمكين تقييم قابل للتتبع، ومستند إلى أسس إحصائية، ومعبأ بوعي بالتراجع، لتحديد مواقع الإخفاقات بدقة والتحقق من صحة التدخلات عبر مراحل الاستيعاب، والاسترجاع، والتصفية، والتوليد.

Xule Liu, Yijun Liu, Chao Li, Shao Kun2026-08-19
🤖 AI

Training with synthetic data for drone detection in thermal imagery

تُثبت هذه الورقة أن استراتيجية التدريب القائمة على البيانات الاصطناعية أولاً، والتي تستفيد من توليد المشاهد الاصطناعية متبوعاً بضبط دقيق على كميات صغيرة من البيانات الحرارية الحقيقية، تتغلب بفعالية على ندرة الصور بالأشعة تحت الحمراء المُصنفة وفجوات النطاق لتحقيق كشف قوي للطائرات بدون طيار من الأرض إلى الجو، حيث أثبت محاذاة مجموعة البيانات أنه أكثر أهمية من حجم النموذج.

Tanel Liiv, Sander Soodla, Nzamba Bignoumba, Alma M. Liezenga, Toomas Pruuden2026-08-19
🤖 AI

MotoSafety: Edge-AI with Learned Temporal Importance for Two-Wheeler Collision Risk Assessment Under Time Pressure

تقدم هذه الورقة MotoSafety، وهي بنية ذكاء اصطناعي حافة خفيفة الوزن تستفيد من الأهمية الزمنية المتعلمة لتحقيق تقييم عالي الدقة ومنخفض زمن الاستجابة لمخاطر التصادم للمركبات ذات العجلتين التي تعمل بالطاقة تحت ضغط الوقت، والتي تم التحقق من صحتها بواسطة مجموعة بيانات محاكي واسعة النطاق وأظهرت أداءً قويًا عبر المجالات الأمنية والنشاط والسريرية.

Sumit S. Shevtekar, Chandresh K. Maurya, Gourab Sil, Subasish Das2026-08-19
🤖 AI

The Model's Tell: Measuring Context-Leakage Attack Signals with Behavior Gauges

تقدم هذه الورقة LeakGauge، وهي طريقة خفيفة الوزن ومتينة تكتشف هجمات تسريب السياق في النماذج اللغوية الكبيرة من خلال تحليل احتمالات رموز مرحلة التعبئة المسبقة (prefill tokens) للاحقة التعبير عن السلوك، محققةً دقة عالية عبر نماذج متنوعة دون الحاجة إلى الوصول إلى الحالات الخفية الداخلية.

Maosen Zhang, Jianshuo Dong, Boting Lu, Wenyue Li, Xiaoping Zhang, Tianwei Zhang, Jie Zhang, Han Qiu2026-08-19
💬 NLP

BEAR-Bench: A Bilingual Enterprise and Academic Reasoning Benchmark for Multimodal Models

تقدم هذه الورقة البحثية BEAR-Bench، وهو معيار تقييم ثنائي اللغة (الإنجليزية-الروسية) يتكون من 1,000 سؤال تم تصنيفها بشرياً بناءً على وثائق مؤسسية وأكاديمية غنية بالنصوص لتقييم قدرات الاستدلال المعقدة وموثوقية كشف الهلوسة للنماذج اللغوية الكبيرة متعددة الوسائط، مما يكشف عن فجوات أداء كبيرة حتى بين الأنظمة الأكثر تطوراً.

Liubov Chubarova, Alexandra Kuleshova, Daniil Volkov, Kirill Sultanov, Alexey Zaytsev2026-08-19