💻 computer science

Do Medical Foundation Models Generalize on the African Brain?

تقيم هذه الورقة مدى تعميم النماذج التأسيسية الطبية على بيانات التصوير بالرنين المغناطيسي للدماغ الأفريقي، وتجد أنه بينما يتباين الأداء باختلاف المهمة وحجم مجموعة البيانات بدلاً من أصل البيانات، فإن العائق الرئيسي أمام النشر القوي يظل هو المحدودية في توافر وتنوع مجموعات بيانات التصوير العصبي الأفريقية.

Kaouther Mouheb, Gonzalo Esteban Mosquera Rojas, Juancito van Leeuwen, Stefan Klein, Esther E. Bron2026-08-03
💻 computer science

Can Synthetic Data Overcome the Generalization Limits of AI-Based Flower and Pod Detection Across Cowpea Breeding Genotypes and Environments?

تُثبت هذه الورقة أن الكشف عن أزهار وثمار اللوبيا القائم على الذكاء الاصطناعي يمكنه التغلب على حدود التعميم عبر الأنماط الجينية والبيئات المتنوعة باستخدام بيانات اصطناعية محسنة — وتحديداً من خلال واقعية الكاميرا المدركة لفجوة النطاق وتمثيلات المدى الديناميكي العالي (HDR) — مقترنة بحد أدنى من التوصيفات الواقعية لسد الفجوة بين الصور المحاكات والواقعية.

Hamid Kamangir, Jonathan Berlingeri, Earl Ranario, Isaac Kazuo Uyehara, Lars Lundqvist, Heesup Yun, Christine H. Diepenb (…)2026-08-03
🤖 AI

A Unified Benchmark of Deep Learning Models for Multi-task 3D Brain Tumor Segmentation from Magnetic Resonance Imaging

تقدم هذه الورقة معياراً موحداً يقيم بإنصاف خمس بنيات للتعلم العميق هي الأحدث حالياً (بما في ذلك الشبكات العصبية الالتفافية CNNs، والمحولات Transformers، ونماذج فضاء الحالة SSMs) لتقسيم أورام الدماغ ثلاثية الأبعاد متعددة المهام على مجموعات بيانات BraTS 2023 و2024 تحت ظروف تجريبية متطابقة لتحليل المقايضات بين دقة التقسيم والكفاءة الحسابية.

Diego J. Torrejón, Luna Y. Hernández, Javier Sánchez2026-08-03
🤖 AI

DiffAttack: Evasion Attacks Against Face Recognition via Latent Diffusion Models

تقدم الورقة البحثية DiffAttack، وهو إطار عمل هجومي مبتكر يستفيد من نماذج الانتشار الكامنة لتوليد صور وجوه عالية الجودة وغير محسوسة تنجح في خداع أنظمة التعرف على الوجوه العميقة بمعدلات نجاح في الهجوم وقابلية للنقل أعلى بكثير مقارنة بالطرق الحالية.

Omid Ahmadieh, Nima Karimian2026-08-03
💻 computer science

Automated classification method of COVID-19 cases from chest CT volumes using 2D and 3D hybrid CNN for anisotropic volumes

تقترح هذه الورقة طريقة هجينة جديدة من نوع (2D/3D CNN) تستخلص الميزات بفعالية من أحجام الأشعة المقطعية للصدر غير المتجانسة عبر تحليل ثلاثة مستويات متعامدة، محققةً دقة تصنيف بنسبة 83.3% لتشخيص كوفيد-19، وهو ما يتفوق على النماذج غير الهجينة.

Masahiro Oda, Tong Zheng, Yuichiro Hayashi, Yoshito Otake, Masahiro Hashimoto, Toshiaki Akashi, Shigeki Aoki, Kensaku Mo (…)2026-08-03
🤖 machine learning

Visual Distribution Anchoring for Efficient Prompt Tuning

تقترح الورقة البحثية إطار عمل "تثبيت التوزيع البصري" (VDA)، وهو إطار تكيف لا يتطلب تدريباً يعمل على تعزيز النماذج اللغوية الرؤيوية المجمدة من خلال تخليق نماذج بصرية على مستوى الفئة من البيانات المستهدفة غير المصنفة، مما يحسن بشكل كبير أداء التعلم الصفري عبر مجالات متنوعة دون الحاجة إلى تسميات مستهدفة، أو تحسين، أو وصول إلى استعلامات الاختبار.

Pouya Parsa, Raoof Zare Moayedi, Seongjin Choi2026-08-03
💻 computer science

SafeNexus: Discovering and Steering Modality-Universal Safety Neurons in MLLMs

تقدم الورقة البحثية SafeNexus، وهو إطار عمل للمحاذاة الآمنة عبر الوسائط، والذي يحدد ويوجه عصبونات السلامة العالمية للوسائط من خلال التثبيط المستهدف وتضخيم التنشيط للدفاع بقوة عن النماذج اللغوية الكبيرة متعددة الوسائط ضد التهديدات المتنوعة عبر الوسائط مع الحفاظ على الفائدة.

Jian Yu, Fei Shen, Cong Wang, Jian Wang, Lu Jin. Xiaoyu Du, Jinhui Tang, Tat-Seng Chua2026-08-03
💻 computer science

Classification of COVID-19 cases from chest CT volumes using hybrid model of 3D CNN and 3D MLP-Mixer

تقترح هذه الورقة نموذجاً هجيناً يجمع بين الشبكات العصبية التلافيفية ثلاثية الأبعاد (3D CNN) ومزيج الشبكات متعددة الطبقات ثلاثية الأبعاد (3D MLP-Mixer) للتصنيف الآلي لمرض كوفيد-19 من أحجام الأشعة المقطعية للصدر، محققةً دقة بنسبة 79.5% تتفوق على نهج الشبكات العصبية التلافيفية ثلاثية الأبعاد التقليدية من خلال الاستفادة الفعالة من ميزات الصور المحلية والعالمية معاً.

Masahiro Oda, Tong Zheng, Yuichiro Hayashi, Yoshito Otake, Masahiro Hashimoto, Toshiaki Akashi, Shigeki Aoki, Kensaku Mo (…)2026-08-03
💬 NLP

Adjudicated Captioning: Multi-Agent Alignment Scoring and Consensus-Distilled Beam Arbitration for Strict Zero-Shot Image Captioning

تقترح الورقة البحثية "التعليق التوضيحي المُحكّم" (Adjudicated Captioning)، وهو إطار عمل للاستدلال متعدد الوكلاء لا يتطلب تدريباً، يعمل على تعزيز التعليق التوضيحي للصور بنمط الصفر الحقيقي الصارم من خلال دمج مشفرات استرجاع مجمدة ومحققات انتباه متقاطع مع أعيد ترتيب (rerankers) مستخلصة بالاتفاق الذاتي، وذلك لتحقيق أداء رائد في مجموعتي بيانات COCO وFlickr30k دون إعادة تدريب النموذج المولد للتعليقات.

Duy Tran Thanh, Thien-Phuc Doan, Long Nguyen-Vu, Ngo Tan Vu Khanh2026-08-03
🤖 AI

Point2Radio: A Foundation Model for Cross-Scene Radio Fields from Material-Aware Point Clouds

يُعد Point2Radio نموذجاً تأسيسياً يستفيد من السحب النقطية المدركة للمواد لتعلم أسبقية انتشار قابلة للنقل عبر بيئات متنوعة، مما يتيح تنبؤاً سريعاً وخالياً من الشبكات (mesh-free) لمجالات راديو عالية الدقة مثل كسب المسار وأطياف القدرة الزاوية مع تقليل الخطأ بشكل كبير مقارنة بالنماذج المرجعية التقليدية الخاصة بكل مشهد.

Chaozheng Wen, Chenghong Bian, Hongze Chen, Jun Zhang2026-08-03