💻 computer science

LocateEdit-Bench: A Benchmark for Instruction-Based Editing Localization

تقدم هذه الورقة البحثية LocateEdit-Bench، وهي مجموعة بيانات واسعة النطاق تضم 231 ألف صورة صُممت لمعالجة الفجوة الحرجة في تحديد مواقع التزييف الناتج عن الذكاء الاصطناناعي من خلال اختبار الأساليب المتبعة مقابل نماذج تحرير الصور الناشئة القائمة على التعليمات.

Shiyu Wu, Shuyan Li, Jing Li, Jing Liu, Yequan Wang2026-02-06
🤖 AI

CAViT -- Channel-Aware Vision Transformer for Dynamic Feature Fusion

تقدم الورقة البحثية نموذج CAViT، وهو محول رؤية (Vision Transformer) ثنائي الانتباه يستبدل طبقات MLP الثابتة بآلية انتباه ديناميكية مدركة للمحتوى على مستوى القنوات لتعزيز دمج الميزات، محققاً دقة فائقة مع تقليل المعلمات والتكلفة الحسابية بشكل كبير عبر مختلف معايير التصوير الطبي والطبيعي.

Aon Safdar, Mohamed Saadeldin2026-02-06
🤖 AI

Poster: Camera Tampering Detection for Outdoor IoT Systems

تقترح هذه الورقة البحثية وتقيم نهجين، أحدهما قائم على القواعد والآخر يعتمد على التعلم العميق، للكشف عن التلاعب بالكاميرا في الصور الثابتة ضمن أنظمة إنترنت الأشياء الخارجية، مبرهنةً على أنه في حين يوفر التعلم العميق دقة أعلى، فإن الأساليب القائمة على القواعد تعد أكثر ملاءمة للبيئات محدودة الموارد، إلى جانب إصدار مجموعة بيانات عامة جديدة لدعم الأبحاث المستقبلية.

Shadi Attarha, Kanaga Shanmugi, Anna Förster2026-02-06
💬 NLP

Ethology of Latent Spaces

تستخدم هذه الدراسة منظوراً إيثولوجياً (سلوكياً) لتوضيح أن الفضاءات الكامنة في نماذج الرؤية واللغة ليست محايدة، بل تُظهر "أنظمة رؤية خوارزمية" متميزة مدفوعة ببيانات التدريب، تولد تفسيرات سياسية وثقافية متباعدة ومتناقضة في كثير من الأحيان للفن، مما يستوجب إعادة تقييم نقدي لكيفية استخدام هذه النماذج في تاريخ الفن الرقمي.

Philippe Boisnard2026-02-06
💻 computer science

Depth as Prior Knowledge for Object Detection

تقدم الورقة البحثية إطار عمل DepthPrior، الذي يستفيد من معلومات العمق كمعرفة مسبقة من خلال أوزان خسارة متخصصة، وتدرج طبقي، وعتبات ثقة، لتحسين اكتشاف الأجسام الصغيرة والبعيدة بشكل كبير دون الحاجة إلى تعديلات هيكلية أو مستشعرات إضافية.

Moussa Kassem Sbeyti, Nadja Klein2026-02-06
💻 computer science

Neuro-Inspired Visual Pattern Recognition via Biological Reservoir Computing

تُثبت هذه الورقة أن الشبكات القشرية المستزرعة في المختبر والمتصلة بمصفوفات الأقطاب الكهربائية متعددة الكثافة يمكن أن تعمل كمستودعات بيولوجية فعالة لتصنيف الأنماط البصرية الثابتة بدقة، والتي تتراوح من الأشكال البسيطة إلى الأرقام المكتوبة بخط اليد، مما يؤكد إمكانية دمج الركائز العصبية الحية في أطر الحوسبة العصبية.

Luca Ciampi, Ludovico Iannello, Fabrizio Tonelli, Gabriele Lagani, Angelo Di Garbo, Federico Cremisi, Giuseppe Amato2026-02-06
💻 computer science

NVS-HO: A Benchmark for Novel View Synthesis of Handheld Objects

تقدم الورقة البحثية NVS-HO، وهو أول معيار لتركيب المشهد من منظور جديد للأجسام المحمولة باليد باستخدام مدخلات RGB فقط، والذي يستخدم تسلسلات مقترنة بين المحمولة باليد والمسجلة على لوح لتقييم وكشف أوجه القصور في طرق تقدير الوضعية والتركيب الحالية في السيناريوهات الواقعية غير المقيدة.

Musawar Ali, Manuel Carranza-García, Nicola Fioraio, Samuele Salti, Luigi Di Stefano2026-02-06
💻 computer science

Self-Supervised Learning with a Multi-Task Latent Space Objective

تقترح هذه الورقة إطار عمل مستقر للتعلم الذاتي متعدد المهام يخصص متنبئات منفصلة لأنواع الرؤية المختلفة (العالمية، والمحلية، والمقنعة) لمعالجة عدم الاستقرار في تدريب تعدد المحاصيل وتحسين الأداء بشكل كبير عبر مختلف بنيات الهياكل الأساسية.

Pierre-François De Plaen, Abhishek Jha, Luc Van Gool, Tinne Tuytelaars, Marc Proesmans2026-02-06
💻 computer science

EoCD: Encoder only Remote Sensing Change Detection

تقدم الورقة البحثية نموذج EoCD، وهو طريقة خفيفة الوزن للكشف عن التغير في الاستشعار عن بعد تستخدم دمجاً زمنياً مبكراً ووحدة ميزات متعددة المقاييس خالية من المعلمات لاستبدال فك التشفير المعقد، مما يحقق توازناً مثالياً بين الأداء وكفاءة الحوسبة مع إثبات أن فعالية النموذج تعتمد أساساً على بنية المشفر.

Mubashir Noman, Mustansar Fiaz, Hiyam Debary, Abdul Hannan, Shah Nawaz, Fahad Shahbaz Khan, Salman Khan2026-02-06
💻 computer science

VisRefiner: Learning from Visual Differences for Screenshot-to-Code Generation

تقترح الورقة البحثية VisRefiner، وهو إطار تدريب يعزز عملية توليد الكود من لقطات الشاشة من خلال تمكين النماذج من التعلم من التباينات البصرية بين المخرجات المُصيغة والتصاميم المستهدفة عبر الإشراف المتوافق مع الفروقات ومرحلة تعلم تعزيزي للتحسين الذاتي.

Jie Deng, Kaichun Yao, Libo Zhang2026-02-06