🤖 AI

Grounding the Score: Explicit Visual Premise Verification for Reliable Vision-Language Process Reward Models

تقدم هذه الورقة البحثية إطار التحقق من المقدمات البصرية الصريحة (EVPV)، وهو إطار عمل خفيف الوزن يعمل على فصل عدم اليقين الإدراكي عن التقييم المنطقي في نماذج مكافأة العمليات الرؤيوية-اللغوية، وذلك عبر توليد قوائم مراجعة بصرية صريحة ومعايرة مكافآت الخطوات بناءً على توافقها مع القيود المستمدة من الصورة، مما يؤدي إلى تحسين دقة إعادة الترتيب وتحديد موقع الخطأ عبر اختبارات الاستدلال متعددة الوسائط.

Junxin Wang, Dai Guan, Weijie Qiu, Zhihang Li, Yongbo Gai, Zhengyi Yang, Mengyu Zhou, Erchao Zhao, Xiaoxi Jiang, Guanjun (…)2026-03-18
🤖 machine learning

An Interpretable Machine Learning Framework for Non-Small Cell Lung Cancer Drug Response Analysis

تقدم هذه الورقة إطار عمل للتعلم الآلي القابل للتفسير يستخدم خوارزمية XGBoost على البيانات متعددة الأوميات للتنبؤ بالاستجابة للأدوية في سرطان الرئة غير صغير الخلايا (LN-IC50)، وتوظف قيم SHAP بالتكامل مع DeepSeek للتحقق من الأهمية البيولوجية لتنبؤات النموذج وتفسيرها.

Ann Rachel, Pranav M Pawar, Mithun Mukharjee, Raja M, Tojo Mathew2026-03-18
💻 computer science

SpikeCLR: Contrastive Self-Supervised Learning for Few-Shot Event-Based Vision using Spiking Neural Networks

تقدم هذه الورقة SpikeCLR، وهو إطار عمل للتعلم التبايني ذاتي الإشراف يُمكّن الشبكات العصبية النبضية من تعلم تمثيلات بصرية قوية من بيانات أحداث غير مصنفة من خلال عمليات تعزيز متخصصة وتدريب التدرج البديل، مما يتفوق بشكل كبير على الأساليب الخاضعة للإشراف في مهام الرؤية القائمة على الأحداث ذات العينات القليلة وشبه المشرفة.

Maxime Vaillant, Axel Carlier, Lai Xing Ng, Christophe Hurter, Benoit R. Cottereau2026-03-18
💻 computer science

Iris: Bringing Real-World Priors into Diffusion Model for Monocular Depth Estimation

تقترح الورقة البحثية Iris، وهو إطار عمل حتمي لتقدير العمق أحادي العدسة يدمج الأولويات الواقعية في نماذج الانتشار عبر جدول زمني حتمي من "الأولويات إلى الهندسة" (PGD) يتكون من مرحلتين، محققاً بذلك تفوقاً في الحفاظ على التفاصيل، وقدرة قوية على التعميم من البيانات الاصطناعية إلى الواقعية، وكفاءة عالية باستخدام بيانات تدريب محدودة.

Xinhao Cai, Gensheng Pei, Zeren Sun, Yazhou Yao, Fumin Shen, Wenguan Wang2026-03-18
💻 computer science

PKINet-v2: Towards Powerful and Efficient Poly-Kernel Remote Sensing Object Detection

يقدم PKINet-v2 عمودًا فقريًا موحدًا للكشف عن الأجسام في الاستشعار عن بُعد يجمع بين التآزر بين النوى الشريطية متباينة الخواص والنوى المربعة متماثلة الخواص للتعامل مع أشكال الأهداف ومقاييسها المتنوعة، مع توظيف استراتيجية إعادة تمثيل النواة غير المتجانسة لتحقيق دقة رائدة مع تسريع في وقت الاستدلال بمقدار 3.9 ضعفًا مقارنة بسلفه.

Xinhao Cai, Liulei Li, Gensheng Pei, Zeren Sun, Yazhou Yao, Wenguan Wang2026-03-18
💻 computer science

DermaFlux: Synthetic Skin Lesion Generation with Rectified Flows for Enhanced Image Classification

يُعد DermaFlux إطار عمل توليديًا قائمًا على التدفق المصحح (rectified flow) يقوم بتخليق صور لآفات جلدية ذات أساس سريري من أوصاف لغوية طبيعية لمعالجة ندرة البيانات وعدم توازن الفئات، مما يعزز بشكل كبير أداء التصنيف الثنائي مقارنة بالأساليب القائمة على الانتشار (diffusion-based methods) الحالية.

Stathis Galanakis, Alexandros Koliousis, Stefanos Zafeiriou2026-03-18
🤖 AI

SF-Mamba: Rethinking State Space Model for Vision

يقدم SF-Mamba نموذج فضاء حالة بصري مبتكر يتغلب على قيود مشفرات الرؤية القائمة على Mamba السابقة من خلال توظيف تبديل الرقع المساعد لتدفق المعلومات ثنائي الاتجاه، وطي الدفعات مع إعادة تعيين دوري للحالة لتعزيز التوازي في وحدة معالجة الرسومات، محققاً أداءً وإنتاجية متفوقين عبر مختلف مهام الرؤية مقارنة بالنماذج المرجعية الحديثة.

Masakazu Yoshimura, Teruaki Hayashi, Yuki Hoshino, Wei-Yao Wang, Takeshi Ohashi2026-03-18
💻 computer science

3D Fourier-based Global Feature Extraction for Hyperspectral Image Classification

تقترح هذه الورقة البحثية بنية HGFNet (Hybrid GFNet)، وهي بنية جديدة لتصنيف الصور فائقة الطيف تجمع بين الالتفافات ثلاثية الأبعاد وثلاثة تحويلات ترددية متكاملة (طيفية أحادية البعد، ومكانية ثنائية الأبعاد، ومكانية-طيفية ثلاثية الأبعاد) وفقدًا بؤريًا تكيُّفيًا لنمذجة التبعيات المكانية-الطيفية العالمية بكفاءة مع معالجة مشكلات القابلية للتوسع وعدم توازن الفئات.

Muhammad Ahmad2026-03-18
💻 computer science

Cross-modal learning for plankton recognition

تقترح هذه الورقة إطار عمل للتعلم عبر الوسائط ذاتي الإشراف يستفيد من بيانات صور العوالق والملفات البصرية غير المصنفة لتدريب نماذج التعرف متعددة الوسائط، محققاً دقة عالية بحد أدنى من البيانات المصنفة مع التفوق على النماذج المرجعية التي تعتمد على الصور فقط.

Joona Kareinen, Veikka Immonen, Tuomas Eerola, Lumi Haraguchi, Lasse Lensu, Kaisa Kraft, Sanna Suikkanen, Heikki Kälviäi (…)2026-03-18
🔭 astrophysics

LenghuSky-8: An 8-Year All-Sky Cloud Dataset with Star-Aware Masks and Alt-Az Calibration for Segmentation and Nowcasting

تقدم هذه الورقة LenghuSky-8، وهي مجموعة بيانات تصوير للسماء بأكملها تمتد لثماني سنوات وتتميز بأقنعة مدركة للنجوم ومعايرة دقيقة للسمت والارتفاع تتيح تجزئة قوية للسحب وتسلط الض light على تحديات التنبؤ بحالة السحب في الأفق القصير للمراصد الفلكية ذاتية التشغيل.

Yicheng Rui, Xiao-Wei Duan, Licai Deng, Fan Yang, Zhengming Dang, Zhengjun Du, Junhao Peng, Wenhao Chu, Umut Mahmut, Kex (…)2026-03-18