💻 computer science

Fractal Characterization of Low-Correlation Signals in AI-Generated Image Detection

تقترح هذه الورقة طريقة جديدة للكشف عن التزييف العميق تستفيد من نظرية الفركتلات (الكسيريات) لقياس الإشارات ذات الارتباط المنخفض، مما يميز بفعالية بين الصور المولدة بواسطة الذكاء الاصطنا</i>thought

Wenwei Xie, Jie Yin, Lu Ma, Xuansong Zhang, Wenjing Zhang2026-04-21
💻 computer science

Spectral Forensics of Diffusion Attention Graphs for Copy-Move Forgery Detection

يقدم البحث إطار عمل GraphSpecForge، وهو إطار عمل لا يتطلب تدريباً يكتشف تزوير الصور بنمط "نسخ-لصق" عبر تحليل الشذوذ الطيفي في رسوم الانتباه الذاتي لنماذج Stable Diffusion سابقة التدريب، مما يثبت كفاءة الكشف عبر معايير متعددة دون الحاجة إلى إعادة تدريب مخصص لكشف التزوير.

H. M. Shadman Tabib, Tasriad Ahmed Tias, Nafis Tahmid2026-04-21
💻 computer science

Frequency-guided Multi-level Reasoning for Scene Graph Generation in Video

تقترح هذه الورقة نموذج FReMuRe، وهو نموذج استدلال متعدد المستويات موجه بالتردد يعالج تحدي توزيع الذيل الطويل في توليد مخطط المشهد للفيديو من خلال توظيف فروع خاصة بالعلاقات، وشبكة تضمين ثنائية الفروع مدركة للتردد، ورؤوس تصنيف مبتكرة لتحسين استدعاء العلاقات النادرة ومتانة الاستدلال الإجمالية بشكل كبير.

Chenxing Li, Yiping Duan, Xiaoming Tao2026-04-21
⚡ electrical engineering

Chaos-Enhanced Prototypical Networks for Few-Shot Medical Image Classification

تقترح هذه الورقة البحثية شبكات النماذج الأولية المعززة بالفوضى (CE-ProtoNet)، والتي تدمج وحدة فوضى لوجستية غير خطية في هيكل ResNet-18 لضخ اضطرابات محكومة أثناء التدريب، مما يؤدي إلى تثبيت التمثيلات الميزتية وتحقيق دقة بنسبة 84.52% في تصنيف أورام الدماغ في ظل ندرة البيانات من خلال التخفيف من عدم استقرار النموذج الأولي الناتج عن الضجيج المورفولوجي.

Chinhtakuntla Meghan Sai, Murarisetty V Sai Kartheek, Sita Devi Bharatula, Karthik Seemakurthy2026-04-21
💻 computer science

The First Challenge on Mobile Real-World Image Super-Resolution at NTIRE 2026: Benchmark Results and Method Overview

تستعرض هذه الورقة نتائج ومنهجيات تحدي NTIRE 2026 لرفع دقة الصور في العالم الحقيقي على الأجهزة المحمولة، حيث تنافس 16 فريقاً لتطوير نماذج فعالة تستعيد الصور عالية الدقة من حالات التدهور غير المعروفة مع تحقيق التوازن بين جودة الصورة وسرعة التنفيذ على الأجهزة المحمولة.

Jiatong Li, Zheng Chen, Kai Liu, Jingkai Wang, Zihan Zhou, Xiaoyang Liu, Libo Zhu, Jue Gong, Radu Timofte, Yulun Zhang (…)2026-04-21
💻 computer science

When Background Matters: Breaking Medical Vision Language Models by Transferable Attack

تقدم هذه الورقة MedFocusLeak، وهو هجوم "الصندوق الأسود" عالي القابلية للنقل الذي يزعزع سلامة نماذج الرؤية واللغة الطبية عبر حقن اضطرابات غير محسوسة في مناطق الخلفية لتشتيت الانتباه عن الاعتلال وتحفيز تشخيصات منطقية ولكنها خاطئة.

Akash Ghosh, Subhadip Baidya, Sriparna Saha, Xiuying Chen2026-04-21
💻 computer science

R-FLoRA: Residual-Statistic-Gated Low-Rank Adaptation for Single-Image Face Morphing Attack Detection

تقدم هذه الورقة البحثية R-FLoRA، وهو إطار عمل مبتكر للكشف عن هجمات دمج الوجوه أحادية الصورة يجمع بين تمثيلات المحولات الرؤيوية ذات النطاق التأسيسي المجمدة مع محولات منخفضة الرتبة ذات بوابات إحصائية متبقية وفقد محاذاة تبايني لتحقيق دقة وحالة تعميم متطورة عبر تقنيات الدمج المتنوعة مع الحفاظ على الكفاءة في الوقت الفعلي.

Raghavendra Ramachandra2026-04-21
💬 NLP

More Than Meets the Eye: Measuring the Semiotic Gap in Vision-Language Models via Semantic Anchorage

تقدم هذه الورقة معيار DIVA ومقياس فجوة المحاذاة الدلالية (Semantic Alignment Gap) لإثبات أن نماذج الرؤية واللغة تظهر تحيزاً متسقاً نحو التفسير الحرفي، حيث يفشل تعزيز الدقة البصرية وحجم النموذج في حل الصعوبات المتعلقة بالمعاني الاصطلاحية المجردة، مما يشير إلى أن التجريد الأيقوني ضروري لتحسين الفهم التركيبي.

Wei He2026-04-21
💻 computer science

MESA: A Training-Free Multi-Exemplar Deep Framework for Restoring Ancient Inscription Textures

تقدم هذه الورقة MESA، وهو إطار عمل عميق متعدد النماذج لا يتطلب تدريباً، يعمل على ترميم أنسجة النقوش القديمة التالفة من خلال تسخير نماذج محفوظة جيداً لتوجيه عملية إعادة البناء عبر مطابقة سمات VGG19، والوزن لكل طبقة بناءً على هندسة الحروف، والتوليف المقنع المقتصر على المناطق المتضررة.

Vasileios Toulatzis, Ioannis Fudos2026-04-21
💻 computer science

Speculative Decoding for Autoregressive Video Generation

تقدم هذه الورقة البحثية SDVG، وهو إطار عمل لفك التشفير الاستنتاجي (speculative decoding) لا يتطلب تدريباً، يعمل على تسريع نماذج انتشار الفيديو ذات التوليد الذاتي (autoregressive video diffusion) عبر توظيف موجه لجودة الصور للتحقق من صحة الكتل المرشحة التي يتم إنشاؤها بواسطة نموذج مسودة صغير، محققاً تسريعاً في الاستدلال يصل إلى 2.09 ضعفاً مع الحفاظ على دقة بصرية عالية.

Yuezhou Hu, Jintao Zhang2026-04-21