💻 computer science

VibeFlow: Versatile Video Chroma-Lux Editing through Self-Supervised Learning

يُعد VibeFlow إطار عمل جديداً للتعلم الذاتي الخاضع للإشراف، يستفيد من نماذج توليد الفيديو مسبقة التدريب ومسار اضطراب مفكك لتحقيق تحرير مرن لـ "كرومات-لوكس" الفيديو (video chroma-lux)—مثل إعادة الإضاءة وإعادة التلوين—دون الحاجة إلى تدريب مُشرف مكلف أو بيانات مقترنة.

Yifan Li, Pei Cheng, Bin Fu, Shuai Yang, Jiaying Liu2026-04-16
🤖 machine learning

MyoVision: A Mobile Research Tool and NEATBoost-Attention Ensemble Framework for Real Time Chicken Breast Myopathy Detection

يقدم هذا البحث MyoVision، وهو إطار عمل متنقل منخفض التكلفة يستخدم الهواتف الذكية الاستهلاكية لالتقاط صور النفاذ الضوئي ونموذج تجميعي من نوع NEATBoost-Attention مُحسَّن بالارتقاء العصبي لتحقيق كشف دقيق وفوري وغير مدمر لاعتلالات عضلات صدر الدجاج، بما يضاهي أداء الأنظمة التصويرية الطيفية فائقة الطيف باهظة الثمن.

Chaitanya Pallerla, Siavash Mahmoudi, Dongyi Wang2026-04-16
⚡ electrical engineering

Learning Class Difficulty in Imbalanced Histopathology Segmentation via Dynamic Focal Attention

تقترح الورقة البحثية آلية "الانتباه البؤري الديناميكي" (DFA)، وهي آلية تتعلم الصعوبة الخاصة بكل فئة مباشرة داخل أجهزة فك تشفير القناع القائمة على الاستعلام عبر انحياز انتباه قابل للتعلم مستمد من أولويات التردد اللوغاريتمي، مما يقدم بديلاً منهجياً لإعادة وزن الخسارة التقليدي لتحسين تقسيم صور الأنسجة المرضية في ظل عدم توازن الفئات.

Lakmali Nadeesha Kumari, Sen-Ching Samson Cheung2026-04-16
💻 computer science

Enhanced Text-to-Image Generation by Fine-grained Multimodal Reasoning

تقترح هذه الورقة إطار عمل "الاستدلال متعدد الوسائط دقيق التفاصيل" (FiMR)، الذي يعزز توليد الصور من النصوص عبر تفكيك المطالبات إلى وحدات دلالية للتحقق منها بواسطة الأسئلة والأجوبة البصرية، مما يتيح تحسيناً ذاتياً مستهدفاً ودقيق التفاصيل يتفوق على الأساليب الحالية في اختبارات التركيب.

Yongjin Kim, Yoonjin Oh, Yerin Kim, Hyomin Kim, Jeeyoung Yun, Yujung Heo, Minjun Kim, Sungwoong Kim2026-04-16
💻 computer science

Reconstruction of a 3D wireframe from a single line drawing via generative depth estimation

تقترح هذه الورقة إطار عمل توليديًا باستخدام نموذج انتشار كامن مع تكييف ControlNet واستراتيجية قناع قائمة على الرسوم البيانية لإعادة بناء الهياكل السلكية ثلاثية الأبعاد من رسومات خطية ثنائية الأبعاد أحادية، وذلك عبر صياغة المهمة كتقدير عمق كثيف مشروط، مما يتيح نمذجة ثلاثية الأبعاد مرنة دون قيود التصميم بمساعدة الحاسوب الصارمة.

Elton Cao, Hod Lipson2026-04-16
💻 computer science

AI Powered Image Analysis for Phishing Detection

تقدم هذه الورقة إطار عمل للتعلم العميق للكشف عن مواقع التصيد الاحتيالي الخادعة بصرياً باستخدام نموذجي ConvNeXt-Tiny وVision Transformer على لقطات شاشة صفحات الويب، مما يثبت أن نموذج ConvNexT-Tiny يوفر كفاءة وأداءً فائقين مع التأكيد على الأهمية البالغة للتقييم المدرك للعتبة (threshold-aware evaluation) من أجل النشر في العالم الحقيقي.

K. Acharya, S. Ale, R. Kadel2026-04-16
💻 computer science

Dehaze-then-Splat: Generative Dehazing with Physics-Informed 3D Gaussian Splatting for Smoke-Free Novel View Synthesis

تقدم هذه الورقة Dehaze-then-Splat، وهو مسار عمل يتكون من مرحلتين لتحدي NTIRE 2026 يجمع بين إزالة الضباب التوليدية وتقنية Gaussian Splatting ثلاثية الأبعاد القائمة على الفيزياء وخسائر تنظيم متخصصة لمعالجة عدم الاتساق في تعدد الرؤى وتحقيق تركيب مشاهد جديدة متفوقة خالية من الدخان.

Yuchao Chen, Hanqing Wang2026-04-16
💻 computer science

VRAG-DFD: Verifiable Retrieval-Augmentation for MLLM-based Deepfake Detection

تقترح الورقة البحثية إطار عمل VRAG-DFD، وهو إطار عمل مبتكر يجمع بين التوليد المعزز بالاسترجاع والتعلم التعزيزي لتزويد النماذج اللغوية الكبيرة متعددة الوسائط (MLLMs) بقدرات استرجاع معرفة التزييف الديناميكية وقدرات الاستدلال النقدي، محققاً أداءً هو الأفضل في حالته في كشف التزييف العميق.

Hui Han, Shunli Wang, Yandan Zhao, Taiping Yao, Shouhong Ding2026-04-16
🔬 mesoscale physics

Automatic Charge State Tuning of 300 mm FDSOI Quantum Dots Using Neural Network Segmentation of Charge Stability Diagram

تقدم هذه الورقة مسار عمل يعتمد على التعلم العميق باستخدام شبكة عصبية تلافيفية من نوع U-Net لضبط النقاط الكمومية بتقنية FDSOI بقطر 300 مم تلقائياً عبر تقسيم مخططات استقرار الشحنة، محققةً معدل نجاح بنسبة 80% في تحديد نظام الشحنة الواحدة، ومقدمةً مساراً قابلاً للتوسع نحو أتمتة الكيوبتات عالية الإنتاجية.

Peter Samaha, Amine Torki, Ysaline Renaud, Sam Fiette, Emmanuel Chanrion, Pierre-Andre Mortemousque, Yann Beilliard2026-04-16
🤖 AI

Beyond Voxel 3D Editing: Learning from 3D Masks and Self-Constructed Data

تقترح الورقة البحثية إطار عمل "Beyond Voxel 3D Editing (BVE)"، وهو إطار يستفيد من مجموعة بيانات ضخمة تم إنشاؤها ذاتياً واستراتيجية قناع خالية من التوسيم لتمكين تحرير أصول ثلاثية الأبعاد بكفاءة وجودة عالية يحافظ على كل من الاتساق الدلالي مع المطالبات النصية والثبات المحلي للمناطق غير المتغيرة.

Yizhao Xu, Hongyuan Zhu, Caiyun Liu, Tianfu Wang, Keyu Chen, Sicheng Xu, Jiaolong Yang, Nicholas Jing Yuan, Qi Zhang2026-04-16