🤖 machine learning

A High Resolution Urban and Rural Settlement Map of Africa Using Deep Learning and Satellite Imagery

تُطوّر هذه الدراسة إطار عمل للتعلم العميق قائم على نموذج DeepLabV3 يدمج صور الأقمار الصناعية متعددة المصادر مع أضواء الليل لإنتاج خريطة للمستوطنات الحضرية والريفية عالية الدقة (10 أمتار) لأفريقيا من عام 2016 إلى عام 2022، متفوقةً بذلك على مجموعات البيانات العالمية الحالية في رصد أنماط المستوطنات دقيقة النطاق.

Mohammad Kakooei, James Bailie, Markus B. Pettersson, Albin Söderberg, Albin Becevic, Adel Daoud2026-02-10
💻 computer science

TIPO: Text to Image with Text Presampling for Prompt Optimization

يُعد TIPO نهجاً فعالاً وخفيف الوزن لتحسين مطالبات تحويل النص إلى صورة تلقائياً، حيث يقوم بتوسيع مدخلات المستخدم البسيطة إلى مطالبات مفصلة وعالية الجودة من خلال أخذ عينات من توزيع فرعي دلالي مستهدف، مما يقدم بديلاً قابلاً للتوسع للطرق التي تعتمد على النماذج اللغوية الكبيرة (LLM) أو التعلم المعزز كثيفة الموارد.

Shih-Ying Yeh, Yi Li, Sang-Hyun Park, Giyeong Oh, Xuehai Wang, Min Song, Youngjae Yu, Shang-Hong Lai2026-02-10
🤖 machine learning

EHCTNet: Enhanced Hybrid of CNN and Transformer Network for Remote Sensing Image Change Detection

تُعد شبكة EHCTNet شبكة هجينة محسنة تجمع بين الـ CNN والـ Transformer، صُممت لتحسين كشف التغيير في الاستشعار عن بُعد من خلال دمج استخراج الميزات متعدد المقاييس، وتنقيب مكونات التردد، وتنقيب الرموز القائم على شبكة كولموغوروف-أرنولد، وذلك لتحقيق كشف أكثر استمرارية ودقة للتغيرات ذات الأهمية.

Junjie Yang, Haibo Wan, Zhihai Shang2026-02-10
💻 computer science

A Survey on Class-Agnostic Counting: Advancements from Reference-Based to Open-World Text-Guided Approaches

تقدم هذه الورقة أول مسح شامل للعد غير المرتبط بفئة (CAC)، حيث تقترح تصنيفاً يوزع المنهجيات إلى نماذج تعتمد على المراجع، ونماذج لا تعتمد على المراجع، ونماذج العالم المفتوح الموجهة بالنصوص، مع تقييم 30 بنية برمجية عبر معايير قياسية رئيسية.

Luca Ciampi, Ali Azmoudeh, Elif Ecem Akbaba, Erdi Sarıtaş, Ziya Ata Yazıcı, Hazım Kemal Ekenel, Giuseppe Amato, Fabrizio (…)2026-02-10
💻 computer science

ImageRAG: Dynamic Image Retrieval for Reference-Guided Image Generation

تُعد ImageRAG طريقة عالية التكيف تعمل على تحسين توليد المفاهيم النادرة أو دقيقة التفاصيل من خلال استرجاع الصور ذات الصلة ديناميكيًا بناءً على المطالبات النصية واستخدامها كـسياق لنماذج تكييف الصور الحالية دون الحاجة إلى تدريب متخصص.

Rotem Shalev-Arkushin, Rinon Gal, Amit H. Bermano, Ohad Fried2026-02-10
🤖 AI

Adversarial Wear and Tear: Exploiting Natural Damage for Generating Physical-World Adversarial Examples

تقدم هذه الورقة البحثية AdvWT، وهي طريقة مبتكرة تولد أمثلة عدائية واقعية في العالم الحقيقي عن طريق حقن اضطرابات استراتيجية في أكواد الأسلوب الكامنة لشبكة ترجمة الصور إلى صور قائمة على شبكات الخصومة التوليدية (GAN)، مما يحاكي بفعالية آثار "التآكل والتمزق" الطبيعية على أشياء مثل لافتات المرور لتضليل الشبكات العصبية العميقة.

Samra Irshad, Seungkyu Lee, Nassir Navab, Hong Joo Lee, Seong Tae Kim2026-02-10
💻 computer science

VisionReasoner: Unified Reasoning-Integrated Visual Perception via Reinforcement Learning

يُعد VisionReasoner إطار عمل موحداً يعزز قدرة النماذج اللغوية البصرية الكبيرة على أداء مهام إدراكية متنوعة — مثل الكشف، والتجزئة، والعد — من خلال دمج عملية استدلال مهيكلة عبر نهج تعلم تعزيزي مبتكر مع آلية مكافأة موحدة.

Yuqi Liu, Tianyuan Qu, Zhisheng Zhong, Bohao Peng, Shu Liu, Bei Yu, Jiaya Jia2026-02-10
🤖 machine learning

Exploring Adversarial Watermarking in Transformer-Based Models: Transferability and Robustness Against Defense Mechanism for Medical Images

تتقصى هذه الورقة مدى عرضة نماذج "محولات الرؤية" (Vision Transformers) في تحليل الصور الجلدية للعلامات المائية العدائية، حيث تُظهر أنه بينما تكون هذه النماذج شديدة التأثر بانخفاض الدقة الناتج عن مثل هذه الهجمات، إلا أنه يمكن تحسين متانتها بشكل كبير من خلال التدريب العدائي.

Rifat Sadik, Tanvir Rahman, Arpan Bhattacharjee, Bikash Chandra Halder, Ismail Hossain, Mridul Banik, Jia Uddin2026-02-10