💻 computer science

Local Precise Refinement: A Dual-Gated Mixture-of-Experts for Enhancing Foundation Model Generalization against Spectral Shifts

تقترح هذه الورقة SpectralMoE، وهو إطار عمل جديد للضبط الدقيق كفء المعلمات (Parameter-Efficient Fine-Tuning) يستخدم بنية "خليط من الخبراء" (Mixture-of-Experts) ذات بوابات مزدوجة لإجراء تنقية للميزات محددة لكل نمط ومتكيفة مكانياً بتوجيه من إشارات العمق، مما يعزز بشكل كبير قدرة النماذج التأسيسية على التعميم ضد التحولات الطيفية في التجزئة الدلالية للاستشعار عن بعد.

Xi Chen, Maojun Zhang, Yu Liu, Shen Yan2026-03-17
💻 computer science

Int3DNet: Scene-Motion Cross Attention Network for 3D Intention Prediction in Mixed Reality

تقترح الورقة البحثية Int3DNet، وهي شبكة مدركة للمشهد تستفيد من دمج الانتباه المتقاطع لإشارات حركة الرأس واليد المتفرقة وهندسة المشهد للتنبؤ مباشرة بمناطق نوايا المستخدم ثلاثية الأبعاد في الواقع المختلط، محققة أداءً قويًا على مجموعات البيانات العامة ومما يتيح استجابات استباقية للنظام دون الحاجة إلى إدراك صريح على مستوى الأجسام.

Taewook Ha, Woojin Cho, Dooyoung Kim, Woontack Woo2026-03-17
🤖 AI

IAML: Illumination-Aware Mirror Loss for Progressive Learning in Low-Light Image Enhancement Auto-encoders

تقترح هذه الورقة البحثية دالة فقدان المرآة المدركة للإضاءة (IAML)، وهي دالة جديدة ضمن إطار تعلم تدريجي قائم على نموذج المعلم والطالب، تعمل على تقطير الميزات النظيفة متعددة المقاييس إلى وحدة فك تشفير الطالب لتحقيق أداء رائد في تحسين الصور ذات الإضاءة المنخفضة.

Farida Mohsen, Tala Zaim, Ali Al-Zawqari, Ali Safa, Samir Belhaouari2026-03-17
🤖 AI

Agentic LLM Workflow for MR Spectroscopy Volume-of-Interest Placements in Brain Tumors

تقترح هذه الورقة سير عمل لنماذج لغوية كبيرة وكيلية (agentic) تولد أحجام اهتمام مرشحة متنوعة باستخدام نماذج المحولات الرؤيوية (vision transformer) بأهداف متباينة، وتختار الموضع الأمثل بناءً على مقاييس كمية، مما يقلل من التباين بين المشغلين ويكيف التصوير بالرنين المغناطيسي الطيفي مع الأولويات السريرية المحددة لأورام الدماغ دون الحاجة إلى إعادة تدريب النموذج لمهام محددة.

Sangyoon Lee, Francesca Branzoli, Małgorzata Marjańska, Patrick Bolan2026-03-17
🤖 machine learning

Deep Learning for BioImaging: What Are We Learning?

تكشف هذه الورقة أن طرق التعلم العميق الحالية لتحليل صور المجهر غالباً ما تفشل في تعلم سمات ذات معنى بيولوجي، حيث لا تؤدي أداءً أفضل من النماذج المرجعية البسيطة بسبب عدم كفاية المعايير التشخيصية التي تحجب هذه المحدودية.

Ivan Svatko, Maxime Sanchez, Ihab Bendidi, Gilles Cottrell, Auguste Genovesio2026-03-17
💻 computer science

DINOv3 with Test-Time Calibration for Automated Carotid Intima-Media Thickness Measurement on CUBS v1

تقدم هذه الورقة إطار عمل يعتمد على DINOv3 مع معايرة وقت الاختبار يحقق دقة ذات صلة سريرية في القياس الآلي لسُمك الطبقة الداخلية المتوسطة للشريان السباتي (CIMT) على مجموعة بيانات CUBS v1، مما يثبت جدوى نماذج الرؤية التأسيسية للقياس الكمي القوي للمؤشرات الحيوية الوعائية.

Zhenpeng Zhang, Jinwei Lu, Yurui Dong, Bo Yuan2026-03-17
🤖 AI

VisualLeakBench: Auditing the Fragility of Large Vision-Language Models against PII Leakage and Social Engineering

تقدم هذه الورقة VisualLeakBench، وهي مجموعة تقييم شاملة تدقق في نماذج اللغة الرؤية الكبيرة المتطورة ضد حقن التعرف الضوئي على الحروف (OCR) وتسريب معلومات الهوية الشخصية (PII) السياقية، مما يكشف عن ثغرات كبيرة في سيناريوهات العالم الحقيقي ويوضح أن المطالبات الدفاعية يمكن أن تقلل بشكل كبير من تسريب البيانات في بعض النماذج مع تسليط الضوء على الطبيعة الحساسة للقوالب فيما يتعلق بمتانة التخفيف.

Youting Wang, Yuan Tang, Yitian Qian, Chen Zhao2026-03-17
💻 computer science

Layout-Guided Controllable Pathology Image Generation with In-Context Diffusion Transformers

تعالج هذه الورقة البحثية أوجه القصور في نماذج الانتشار الموجهة بالنصوص الموجودة حالياً في مجال تخليق صور علم الأمراض من خلال تقديم إطار عمل للتعليق التوضيحي يعتمد على نماذج اللغات الكبيرة متعددة الوسائط (LVLM) القابلة للتوسع لإنشاء مجموعات بيانات دقيقة التخطيط والتشخيص، واقتراح محول الانتشار داخل السياق (IC-DiT)، وهو نموذج مبتكر يحقق قدرة فائقة على التحكم المكاني، والدقة المورفولوجية، والاتساق التشخيصي لكل من توليد الصور والمهام السريرية اللاحقة.

Yuntao Shou, Xiangyong Cao, Qian Zhao, Deyu Meng2026-03-17
💻 computer science

WebVR: Benchmarking Multimodal LLMs for WebPage Recreation from Videos via Human-Aligned Visual Rubrics

تقدم هذه الورقة WebVR، وهو معيار مرجعي جديد ومعيار تقييم بصري متوافق مع المعايير البشرية مصمم لتقييم قدرة النماذج اللغوية الكبيرة متعددة الوسائط على إعادة إنشاء صفحات الويب بأمانة من فيديوهات توضيحية، مما يعالج الفجوة في أبحاث توليد الويب المشروط بالفيديو من خلال مجموعة بيانات منسقة اصطناعياً تضم 175 صفحة متنوعة.

Yuhong Dai, Yanlin Lai, Mitt Huang, Hangyu Guo, Dingming Li, Hongbo Peng, Haodong Li, Yingxiu Zhao, Haoran Lyu, Zheng Ge (…)2026-03-17
🤖 AI

Comparative Analysis of Deep Learning Architectures for Multi-Disease Classification of Single-Label Chest X-rays

تقيم هذه الدراسة بشكل منهجي سبعة من بنيات التعلم العميق على مجموعة بيانات متوازنة مكونة من 18,080 صورة أشعة سينية للصدر، حيث أظهرت أن نموذج ConvNeXt-Tiny يحقق أعلى دقة (92.31%) بينما يوفر نموذج MobileNetV2 أفضل كفاءة في عدد المعلمات، مع تجاوز جميع النماذج دقة 90% وإظهار أداء يقارب المثالية في تصنيف السل وكوفيد-19.

Ali M. Bahram, Saman Muhammad Omer, Hardi M. Mohammed2026-03-17