⚡ electrical engineering

AMO-ENE: Attention-based Multi-Omics Fusion Model for Outcome Prediction in Extra Nodal Extension and HPV-associated Oropharyngeal Cancer

تقدم هذه الورقة AMO-ENE، وهو مسار دمج أوميكس متعدد يعتمد على آلية الانتباه ومؤتمت بالكامل، يقوم بدمج سمات التصوير المستمدة من الأشعة المقطعية مع البيانات السريرية للكشف عن الامتداد خارج العقد اللمفاوية وتحسين التنبؤ بالنتائج بشكل كبير لمرضى سرطان البلعوم الفمي المرتبط بفيروس الورم الحليمي البشري.

Gautier Hénique, William Le, Gabriel Dayan, Coralie Brodeur, Kristoff Nelson, Apostolos Christopoulos, Edith Filion, Phu (…)2026-04-13
⚡ electrical engineering

UHD Low-Light Image Enhancement via Real-Time Enhancement Methods with Clifford Information Fusion

تقترح هذه الورقة شبكة مبتكرة لتحسين الصور فائقة الدقة (UHD) في ظروف الإضاءة المنخفضة في الوقت الفعلي، والتي تستفيد من دمج الميزات الهندسية عبر جبر كليفورد وبنية "يو-نت" (U-Net) خفيفة الوزن ثنائية المسار للتغلب على اختناقات الذاكرة، محققةً استدلالاً بمستوى الميلي ثانية على الأجهزة الطرفية مع التفوق على النماذج الرائدة في جودة الاستعادة.

Xiaohan Wang, Chen Wu, Dawei Zhao, Guangwei Gao, Dianjie Lu, Guijuan Zhang, Linwei Fan, Xu Lu, Shuai Wu, Hang Wei, Zhuor (…)2026-04-13
💻 computer science

Structure-Aware Fine-Grained Gaussian Splatting for Expressive Avatar Reconstruction

تقترح الورقة البحثية طريقة "التشتت الغاوسي دقيق التفاصيل والمدرك للبنية" (SFGS)، وهي طريقة مبتكرة أحادية المرحلة تعيد بناء نماذج رمزية بشرية كاملة الجسم عالية الدقة ومدركة للطوبولوجيا، مع تفاصيل تعبيرية مثل حركات اليد وتعبيرات الوجه من مقاطع فيديو أحادية العدسة، وذلك عبر دمج المستويات الثلاثية المكانية، والمستويات السداسية الزمنية، ووحدة غاوسية مدركة للبنية.

Yuze Su, Hongsong Wang, Jie Gui, Liang Wang2026-04-13
💻 computer science

Multimodal Anomaly Detection for Human-Robot Interaction

تقدم هذه الورقة MADRI، وهو إطار عمل للكشف عن الشذوذ متعدد الوسائط للتفاعل بين الإنسان والروبوت يعزز السلامة من خلال إعادة بناء ناقلات سمات ذات دلالات دلالية مستمدة من تدفقات الفيديو، وأجهزة الاستشعار الداخلية للروبوت، والرسوم البيانية للمشهد لتحديد كل من الانحرافات البيئية وانحرافات النظام الداخلية بفعالية.

Guilherme Ribeiro, Iordanis Antypas, Leonardo Bizzaro, João Bimbo, Nuno Cruz Garcia2026-04-13
💬 NLP

Arbitration Failure, Not Perceptual Blindness: How Vision-Language Models Resolve Visual-Linguistic Conflicts

تُثبت هذه الورقة أن النماذج اللغوية-البصرية لا تعاني من العمى الإدراكي عند الفشل في ربط الأدلة البصرية، بل تشهد فشلاً في التحكيم حيث يوجد ترميز بصري قوي ومع ذلك يتم تجاوزه بواسطة المعرفة المسبقة، وهي فجوة يمكن معالجتها من خلال تدخلات مستهدفة في الطبقات المبكرة.

Farhad Nooralahzadeh, Omid Rohanian, Yi Zhang, Jonathan Fürst, Kurt Stockinger2026-04-13
🧬 biology

Cluster-First Labelling: An Automated Pipeline for Segmentation and Morphological Clustering in Histology Whole Slide Images

تقدم هذه الورقة مساراً متكاملاً يعتمد على التقنيات السحابية الأصلية، يعمل على أتمتة عملية توصيف صور الشرائح النسيجية الكاملة من خلال تقسيم مكونات الأنسجة، وتجميعها مورفولوجياً، وتمكين الموصِّفين البشريين من تسمية المجموعات الممثلة بدلاً من الكائنات الفردية، مما يقلل الجهد مع تحقيق دقة توافق تبلغ 96.8% مع التسميات اليدوية عبر أنواع مختلفة من الأنسجة.

Muhammad Haseeb Ahmad, Sharmila Rajendran, Damion Young, Jon Mason2026-04-13
💻 computer science

Do Vision Language Models Need to Process Image Tokens?

تتحدى هذه الورقة الافتراض القائل بأن النماذج اللغوية البصرية تتطلب معالجة عميقة ومستمرة لرموز الصور، وذلك من خلال إثبات أن التمثيلات البصرية تتقارب بسرعة نحو حالة مستقرة ومنخفضة التعقيد، مما يشير إلى أن الطبقات البصرية الأعمق تقدم عوائد متناقصة وأن ضرورة هذه المعالجة تعتمد بشكل كبير على المهمة.

Sambit Ghosh, R. Venkatesh Babu, Chirag Agarwal2026-04-13
💻 computer science

AsymLoc: Towards Asymmetric Feature Matching for Efficient Visual Localization

تقدم الورقة البحثية AsymLoc، وهو إطار عمل تقطير مبتكر يتيح تحديد المواقع البصرية بكفاءة على أجهزة الحافة ذات الموارد المحدودة من خلال محاذاة نموذج طالب خفيف الوزن مع نموذج معلم ضخم عبر أهداف هندسية وأهداف مشتركة للكاشف والوصف، محققاً دقة تضاهي أحدث ما توصل إليه العلم مع تقليل التكلفة الحسابية بشكل كبير.

Mohammad Omama, Gabriele Berton, Eric Foxlin, Yelin Kim2026-04-13
⚡ electrical engineering

DSVTLA: Deep Swin Vision Transformer-Based Transfer Learning Architecture for Multi-Type Cancer Histopathological Cancer Image Classification

تقترح هذه الورقة البحثية DSVTLA، وهي بنية تعلم نقل تعتمد على محول رؤية "Swin" العميق، تدمج سمات ResNet50 لتحقيق دقة فائقة تقارب الكمال في تصنيف الصور النسيجية السرطانية متعددة الأنواع عبر مجموعات بيانات وظروف متنوعة.

Muazzem Hussain Khan, Tasdid Hasnain, Md. Jamil khan, Ruhul Amin, Md. Shamim Reza, Md. Al Mehedi Hasan, Md Ashad Alam2026-04-13
💻 computer science

Incremental Semantics-Aided Meshing from LiDAR-Inertial Odometry and RGB Direct Label Transfer

تقترح هذه الورقة مسار عمل تدريجي لبيانات RGB+LiDAR يستفيد من نماذج الرؤية التأسيسية لنقل التصنيفات بشكل مباشر والدمج القائم على المساعدة الدلالية لـ TSDF لتوليد شبكات (meshes) عالية الدقة ومصنفة دلالياً من عمليات المسح الداخلي، مما يتغلب بفعالية على الانزياح الهندسي وندرة السحب النقطية ليتفوق على النماذج المرجعية الحالية.

Muhammad Affan, Ville Lehtola, George Vosselman2026-04-13