🤖 AI

Off-The-Shelf Image-to-Image Models Are All You Need To Defeat Image Protection Schemes

تُثبت هذه الورقة أن نماذج الذكاء الاصطناعي التوليدية الجاهزة لتحويل الصور إلى صور يمكن إعادة توظيفها ببساطة كمزيلات ضجيج عامة للتغلب بفعالية على مجموعة واسعة من مخططات حماية الصور، متفوقة بذلك على الهجمات المتخصصة وكاشفةً عن ثغرة حرجة في آليات الدفاع الحالية.

Xavier Pleimling, Sifat Muhammad Abdullah, Gunjan Balde, Peng Gao, Mainack Mondal, Murtuza Jadliwala, Bimal Viswanath2026-02-26
💻 computer science

WHOLE: World-Grounded Hand-Object Lifted from Egocentric Videos

تُعد WHOLE طريقة مبتكرة تعيد بناء حركة اليد والجسم بشكل شمولي في فضاء العالم من فيديوهات المنظور الشخصي الصعبة، وذلك عبر الاستفضاء من نموذج توليدي مُتعلم للاستدلال المشترك حول تفاعلاتهما، مما يحقق أداءً رائدًا في التعامل مع حالات الحجب وضمان اتساق العلاقات بين اليد والجسم.

Yufei Ye, Jiaman Li, Ryan Rong, C. Karen Liu2026-02-26
🤖 AI

Interpretable Medical Image Classification using Prototype Learning and Privileged Information

تقترح هذه الورقة نموذج Proto-Caps، وهو نموذج لتصنيف الصور الطبية قابل للتفسير يدمج شبكات الكبسولة (capsule networks)، وتعلم النماذج الأولية (prototype learning)، والمعلومات المميزة لتحقيق دقة تضاهي أحدث ما توصل إليه العلم في التنبؤ بخباثة عقيدات الرئة، مع توفير استدلال بصري قائم على الحالات لغرض التحقق من قبل أطباء الأشعة.

Luisa Gallee, Meinrad Beer, Michael Goetz2026-02-25
💻 computer science

A deep learning framework for efficient pathology image analysis

تقدم الورقة البحثية EAGLE، وهو إطار عمل للتعلم العميق يسخر النماذج التأسيسية لتحليل المناطق المعلوماتية في صور علم الأمراض بشكل انتقائي، محققاً أداءً هو الأفضل من نوعه عبر 43 مهمة مع تقليل وقت الحوسبة بنسبة تزيد عن 99% لتمكين سير عمل سريري فوري ومتاح وقابل للتدقيق.

Peter Neidlinger, Tim Lenz, Sebastian Foersch, Chiara M. L. Loeffler, Jan Clusmann, Marco Gustav, Lawrence A. Shaktah, R (…)2026-02-25
💻 computer science

VISIONLOGIC: From Neuron Activations to Causally Grounded Concept Rules for Vision Models

تُعد VisionLogic إطار عمل عصبي-رمزي مبتكر يولد تفسيرات هرمية وفية لنماذج الرؤية عبر تعلم عتبات التنشيط لتشكيل المحمولات، واستنتاج قواعد منطقية على مستوى الفئات، وتأصيل هذه القواعد في مفاهيم بصرية تم التحقق منها سببياً من خلال اختبار الاستئصال.

Chuqin Geng, Yuhe Jiang, Ziyu Zhao, Haolin Ye, Anqi Xing, Li Zhang, Xujie Si2026-02-25
⚡ electrical engineering

Reproducing and Improving CheXNet: Deep Learning for Chest X-ray Disease Classification

تعيد هذه الورقة إنتاج خوارزمية CheXNet وتستكشف نماذج التعلم العميق المحسنة على مجموعة بيانات NIH ChestX-ray14، محققةً متوسط مساحة تحت منحنى خصائص تشغيل المستقبِل (AUC-ROC) يبلغ 0.85 ومتوسط درجة F1 يبلغ 0.39 عبر 14 تصنيفاً للأمراض.

Daniel J. Strick, Carlos Garcia, Anthony Huang, Thomas Gardos2026-02-25
💻 computer science

SpikePingpong: Spike Vision-based Fast-Slow Pingpong Robot System

تقدم هذه الورقة SpikePingpong، وهو نظام روبوتي جديد لتنس الطاولة يدمج بنية "سريع-بطيء" (Fast-Slow) تجمع بين الرؤية القائمة على النبضات (spike-based vision) للتنبؤ السريع بالمسار مع التعلم بالتقليد للتخطيط الدقيق للحركة، محققاً ضرباً عالي الدقة للكرة في البيئات الديناميكية.

Hao Wang, Chengkai Hou, Xianglong Li, Yankai Fu, Chenxuan Li, Ning Chen, Gaole Dai, Jiaming Liu, Tiejun Huang, Shanghang (…)2026-02-25
💻 computer science

Improving Motion in Image-to-Video Models via Adaptive Low-Pass Guidance

تقدم هذه الورقة البحثية طريقة التوجيه التكيفي للترددات المنخفضة (ALG)، وهي طريقة لا تتطلب تدريباً تعمل على تعزيز ديناميكيات الحركة في توليد الفيديو من الصور عبر تصفية التفاصيل عالية التردد من الصورة الشرطية خلال مراحل إزالة الضجيج المبكرة، مما يمنع النموذج من الإفراط في التكيف مع المظاهر الساكنة مع الحفاظ على جودة الصورة والمواءمة مع النص.

June Suk Choi, Kyungmin Lee, Sihyun Yu, Yisol Choi, Jinwoo Shin, Kimin Lee2026-02-25
🤖 AI

Addressing Camera Sensors Faults in Vision-Based Navigation: Simulation and Dataset Development

تتناول هذه الورقة نقص البيانات المعيبة التمثيلية لتدريب أنظمة كشف الأعطال القائمة على الذكاء الاصطناي في الملاحة القائمة على الرؤية، وذلك من خلال التوصيف المنهجي لأعطال مستشعر الكاميرا وتقديم إطار محاكاة لإنشاء مجموعة بيانات شاملة من الصور المحقونة بالأعطال لمهام الاستكشاف بين الكواكب.

Riccardo Gallon, Fabian Schiemenz, Alessandra Menicucci, Eberhard Gill2026-02-25
🤖 AI

FedGIN: Federated Learning with Dynamic Global Intensity Non-linear Augmentation for Organ Segmentation using Multi-modal Images

يُعد FedGIN إطار عمل للتعلم الاتحادي يعالج ندرة البيانات، وانزياح النطاق، والمخاوف المتعلقة بالخصوصية في التصوير الطبي متعدد الأنماط من خلال دمج وحدة تعزيز "الشدة العالمية غير الخطية" (GIN) خفيفة الوزن لتحسين أداء تقسيم الأعضاء عبر الأنماط المختلفة بشكل كبير دون مشاركة بيانات المرضى الخام.

Sachin Dudda Nagaraju, Ashkan Moradi, Bendik Skarre Abrahamsen, Mattijs Elschot2026-02-25