💻 computer science

Conditions for well-posed color recovery in scattering media

تحدد هذه الورقة شروطاً كافية لاستعادة الألوان بشكل جيد في الأوساط المشتتة من خلال إثبات أن أنماط الاستعادة عبر البكسلات، وليس مجرد تحسينات المستشعرات وحدها، يمكن أن تقيد الحل بشكل فريد للتغلب على عدم التحديد المتأصل الناتج عن الإسقاط الطيفي ومعلمات الوسط غير المعروفة.

Grigory Solomatov, Derya Akkaynak2026-05-06
💻 computer science

Parameter-Efficient Multi-View Proficiency Estimation: From Discriminative Classification to Generative Feedback

تقدم هذه الورقة ثلاثة أساليب فعالة من حيث المعلمات — SkillFormer وPATS وProfVLM — تعمل على تطوير تقدير الكفاءة متعدد الرؤى على مجموعة بيانات Ego-Exo4D من خلال تحقيق دقة رائدة مع استخدام موارد أقل بكثير، مع الانتقال من التصنيف البسيط إلى توليد ملاحظات تفسيرية بأسلوب الخبراء.

Edoardo Bianchi, Antonio Liotta2026-05-06
💻 computer science

A Deeper Dive into the Irreversibility of PolyProtect: Making Protected Face Templates Harder to Invert

تعمل هذه الورقة على تعزيز عدم قابلية العكس لطريقة حماية قالب الوجه PolyProtect من خلال تقديم خوارزمية اختيار مفتاح تعمل على تحسين معاملات متعدد الحدود لمقاومة هجمات العكس والموازنة بين المقايضة بين الأمان ودقة التعرف، مع معالجة مشكلات الأداء أيضاً من خلال تطبيع التضمين.

Vedrana Krivokuća Hahn, Jérémy Maceiras, Sébastien Marcel2026-05-06
💻 computer science

Quantifying the human visual exposome with vision language models

تقدم هذه الورقة إطار عمل قابلاً للتوسع يجمع بين التقييم اللحظي البيئي ونماذج الرؤية واللغة لقياس التعرض البصري البشري، مما يثبت أن التحليل الموضوعي للصور من منظور الشخص الأول يمكن أن يتنبأ بفعالية بمخرجات الصحة العقلية مثل الوجدان والتوتر المزمن.

Christian Rominger (University of Graz), Andreas R. Schwerdtfeger (University of Graz), Malay Gaherwar Singh (TU Dresden (…)2026-05-06
💻 computer science

Task-Aware Scanning Parameter Configuration for Robotic Inspection Using Vision Language Embeddings and Hyperdimensional Computing

تقدم هذه الورقة ScanHD، وهو إطار عمل للحوسبة فائقة الأبعاد يستفيد من تضمينات الرؤية واللغة لضبط معلمات جهاز قياس الليزر الروبوتي ذاتيًا بناءً على تعليمات باللغة الطبيعية وملاحظات RGB، محققًا دقة عالية وزمن استجابة منخفضًا على مجموعة بيانات جديدة تم إنشاؤها في العالم الحقيقي تسمى Instruct-Obs2Param.

Zhiling Chen, David Gorsich, Matthew P. Castanier, Yang Zhang, Jiong Tang, Farhad Imani2026-05-06
💻 computer science

RD-ViT: Recurrent-Depth Vision Transformer for Semantic Segmentation with Reduced Data Dependence Extending the Recurrent-Depth Transformer Architecture to Dense Prediction

تقدم الورقة البحثية RD-ViT، وهو محول رؤية متكرر العمق (Recurrent-Depth Vision Transformer) يستبدل المجموعات العميقة القياسية بكتلة واحدة مشتركة لتقليل عدد المعلمات والاعتماد على البيانات بشكل كبير، مع تحقيق أداء رائد في تقسيم الصور الدلالي على معايير التصوير بالرنين المغناطيسي للقلب من خلال آليات مثل وقت الحوسبة التكيفي (Adaptive Computation Time) ومزيج الخبراء (Mixture-of-Experts).

Renjie He2026-05-06
🤖 machine learning

Enhanced 3D Brain Tumor Segmentation Using Assorted Precision Training

تقدم هذه الورقة نهجاً متطوراً للتقطيع ثلاثي الأبعاد المبكر لأورام الدماغ باستخدام بنية SegResNet المدربة عبر تعدد الدقة التلقائي، محققةً درجة دايس (Dice score) تبلغ 0.84 لمركز الورم، و0.90 للورم الكامل، و0.79 للورم المعزز.

Adwaitt Pandya, Ozioma C. Oguine, Harita Bhargava, Shrikant Zade2026-05-06
🤖 AI

PipeFusion: Patch-level Pipeline Parallelism for Diffusion Transformers Inference

تُعد PipeFusion منهجية استنتاج متوازية مبتكرة لنماذج "Diffusion Transformers" تعمل على تقسيم الصور إلى رقع وتوزيع طبقات النموذج عبر وحدات معالجة رسومية متعددة، مستفيدة من التوازي في خطوط الأنابيب على مستوى الرقع وإعادة استخدام خرائط الميزات القديمة لتقليل تكاليف الاتصال واستهلاك الذاكرة بشكل كبير مع تحقيق أداء رائد في توليد الصور عالية الدقة.

Jiarui Fang, Jinzhe Pan, Aoyu Li, Xibo Sun, Jiannan Wang2026-05-05
💻 computer science

A Comprehensive Review of Fish Feeding Behavior Analysis in Aquaculture: Tasks, Techniques, and Applications

تقدم هذه الورقة مراجعة موضوعية شاملة لتحليل سلوك تغذية الأسماك في تربية الأحياء المائية من خلال الفحص المنهجي لمهامه الجوهرية، ومنهجياته التقنية (بما في ذلك الرؤية الحاسوبية، والصوتيات، والمستشعرات، والدمج متعدد الوسائط)، وتطبيقاته العملية، مع تحديد التحديات الحالية ورسم الاتجاهات البحثية المستقبلية لتعزيز التغذية الذكية والإدارة المستدامة لتربية الأحياء المائية.

Shulong Zhang, Daoliang Li, Jiayin Zhao, Mingyuan Yao, Yingyi Chen, Haihua Wang2026-05-05
⚡ electrical engineering

Interlaced R2D2 DNN Series for Scalable Non-Cartesian MRI with Sensitivity Self-calibration

تقدم هذه المساهمة iR2D2، وهو إطار عمل للتعلم العميق قابل للتوسع يوسع نموذج R2D2 ببنية متداخلة للقيام بشكل مشترك بالمعايرة الذاتية لخرائط الحساسية وإعادة بناء الصور عالية الدقة لتسريع التصوير بالرنين المغناطيسي غير الكارتيزي مع التغلب على قيود التدريب للشبكات التقليدية غير المطوية.

Shijie Chen, Yiwei Chen, Amir Aghabiglou, Motahare Torki, Chao Tang, Ruud B. van Heeswijk, Yves Wiaux2026-05-05