💻 computer science

SynVA: A Modular Toolkit for Vessel Generation and Aneurysm Editing

تقدم هذه الورقة SynVA، وهي مجموعة أدوات نمطية تجمع بين مطابقة التدفق والأساليب الإجرائية لتوليد مجموعات بيانات اصطناعية واسعة النطاق ومتسقة تشريحياً لتمدد الأوعية الدموية داخل الجمجمة، مما يعالج ندرة البيانات لتدريب نماذج التعلم العميق في أبحاث الأوعية الدموية الدماغية.

Marten J. Finck, Niklas C. Koser, Sarker M. Mahfuz, Tameem Jahangir, Jon E. Wilhelm, Daniel Behme, Naomi Larsen, Wojtek (…)2026-05-19
💻 computer science

SparseSAM: Structured Sparsification of Activations in Segment Anything Models

تُعد SparseSAM إطار عمل لا يتطلب تدريباً يعمل على تسريع نماذج "Segment Anything" من خلال تقديم آلية "Stripe-Sort Attention" و"Residual-Consistency MLP" لتقليل كثافة طبقات الانتباه وMLP معاً، مما يحقق تسريعاً كبيراً في الاستدلال وتقليلاً في استهلاك الذاكرة مع حد أدنى من فقدان الدقة مقارنة بالطرق الحالية.

Hoai-Chau Tran, Chi H. Nguyen, Duy M. H. Nguyen, Mathias Niepert, Fan Lai, Khoa D. Doan2026-05-19
💻 computer science

TouchMap-OR: Multi-View 3D Mapping of Hand-Surface Contacts

يُعد نظام TouchMap-OR نظام رؤية متعدد الزوايا يعتمد على تقنية RGB-D، يقوم بإعادة بناء سجلات تلامس سطح اليد ثلاثية الأبعاد والمحددة للهوية في غرف العمليات من خلال دمج شبكات اليد المفصلية، وتتبع الهياكل العظمية لمتعدد الأشخاص، والنمذجة البيئية الدلالية لاستنتاج متى وأين يلمس الممارسون الصحيون أسطحاً محددة.

Sophokles Ktistakis, Rui Wang, Bastian Grande, Hugo Sax2026-05-19
💻 computer science

MARQUIS: A Three-Stage Pipeline for Video Retrieval-Augmented Generation

يُعد MARQUIS عبارة عن خط معالجة ثلاثي المراحل يعزز بشكل كبير توليد النصوص المدعم باسترجاع الفيديو من خلال معالجة أوجه القصور في التعامل مع الاستعلامات المعقدة وتوليف الفيديوهات المتعددة عبر توسيع الاستعلام، واستخراج الأدلة المهيكلة، وتوليد المقالات المنضبط، محققاً أداءً هو الأفضل في فئته في مهمة MAGMaR2026 المشتركة.

Debashish Chakraborty, Dengjia Zhang, Jialiang Jin, Hanting Liu, Katherine Guerrerio, Hanxiang Qin, Tyler Skow, Alexande (…)2026-05-19
💻 computer science

A simple approach for biometrics: Finger-knuckle prints recognition based on a Sobel filter and similarity measures

تقترح هذه الورقة طريقة سريعة وفعالة للتعرف على بصمة مفاصل الأصابع تستخدم مرشح سوبل (Sobel filter) والحد من الضوضاء لإنشاء صور ثنائية للمقارنة عبر مقاييس التشابه، محققةً معدل إيجابي حقيقي يصل إلى 17.02% على مجموعة بيانات كبيرة.

E. O. Rodrigues, T. M. Porcino, Aura Conci, Aristofanes C. Silva2026-05-19
💻 computer science

Brain-inspired spike-timing plasticity for reliable label-efficient event-camera vision

تقترح هذه الورقة إطار عمل للرؤية بكاميرا الحدث مستوحى من الدماغ، وفعال في استهلاك الملصقات، يستخدم ثلاث وحدات محلية لللدونة المعتمدة على توقيت النبضات (STDP) لتحقيق كشف عالي الدقة للأجسام على أجهزة وحدة المعالجة المركزية (CPU)، مما يقلل بشكل كبير من متطلبات الملصقات والإنذارات الكاذبة مع التفوق على الطرق التقليدية القائمة على التدرج والتجميع من حيث المتانة والموثوقية.

Mohamad Yazan Sadoun, Sarah Sharif, Yaser Mike Banad2026-05-19
💻 computer science

Patch-MoE Mamba: A Patch-Ordered Mixture-of-Experts State Space Architecture for Medical Image Segmentation

تقترح الورقة البحثية نموذج Patch-MoE Mamba، وهو بنية هندسية جديدة لتقسيم الصور الطبية تتغلب على قيود نماذج Mamba الحالية من خلال إدخال آلية مسح مرتبة للرقع هرمية للحفاظ على الهياكل المكانية المحلية ووحدة خليط من الخبراء لدمج الميزات متعددة الاتجاهات بشكل تكيفي، محققة أداءً فائقاً عبر معايير متنوعة لتقسيم السلائل والآفات الجلدية.

Diego Adame, Fabian Vazquez, Jose A. Nunez, Huimin Li, Jinghao Yang, Erik Enriquez, DongChul Kim, Haoteng Tang, Bin Fu (…)2026-05-19
💻 computer science

GraSP-VL: Length as a Semantic Granularity Interface for Vision-Language Representations

يقدم GraSP-VL تحويلاً بادئةً (prefix transform) مشتركاً، قابلاً للتعلم، وشبه متعامد، يعيد تنظيم تمثيلات الرؤية واللغة المجمدة في واجهة "ماتريوشكا دلالية" (Semantic Matryoshka)، مما يتيح وصولاً يمكن التحكم فيه إلى التدرج الدلالي من الخشن إلى الناعم بمجرد تغيير طول التمثيل مع الحفاظ على الهندسة كاملة الأبعاد للنموذج الأصلي وأدائه في التعلم الصفري.

Zesheng Li, Chengchang Pan, Honggang Qi2026-05-19
💻 computer science

Unleashing Vision Transformer Potential In Image Quality Assessment via Global-Local Adaptive Interaction

تقدم هذه الورقة البحثية "مهايئ التفاعل العالمي-المحلي" (GLIA)، وهو إطار عمل مبتكر يعزز تقييم جودة الصور الأعمى من خلال الاستفادة بكفاءة من نماذج "رؤية المحولات" (Vision Transformers) سابقة التدريب عبر آلية ثنائية المسار لتحقيق دقة ومتانة فائقتين بعدد أقل بكثير من المعلمات القابلة للتدريب.

Yu Li, Puchao Zhou, Yachun Mi, Yanfeng Wu, Xiaoming Wang, Shaohui Liu2026-05-19
💻 computer science

Towards Universal Physical Adversarial Attacks via a Joint Multi-Objective and Multi-Model Optimization Framework

تقترح هذه الورقة إطار العمل الأمثل المشترك متعدد الأهداف ومتعدد النماذج (JMOF)، والذي يستخدم محاذاة التدرج المتعامد وآلية كبح ثنائية المستوى لحل صراعات التدرج وتعزيز قابلية النقل عبر النماذح، مما يحقق هجمات فيزيائية تنافسية عالمية تخدع بفعالية مهام الرؤية متنوعة الصندوق الأسود.

Ziyang Liu, Hongyuan Wang, Zijian Wang, Yinxi Lu, Yunzhao Zang, Zhiqiang Yan, Qianhao Ning2026-05-19