💻 computer science

LDMFNet: A Lightweight Dual-Modal Fusion Network for Accurate Multispectral Object Detection

تقترح الورقة البحثية شبكة LDMFNet، وهي شبكة دمج ثنائية الأنماط خفيفة الوزن تتميز بهيكل دعم ثنائي الميزات ووحدات انتباه متخصصة لتحقيق كشف دقيق وفعال للأجسام متعددة الأطياف عبر مجموعات بيانات مختلفة مع التفوق على الخوارزميات الحالية في الدقة والتعميم.

Dongping Cao, Guogang Li2026-08-10
💻 computer science

BMTransUNet: Boundary-Aware Gated Multimodal Transformer for Remote Sensing Semantic Segmentation

تقترح الورقة البحثية BMTransUNet، وهو نموذج U-Net متعدد الوسائط ذو بوابات مدرك للحدود، يدمج بيانات RGB وDSM من خلال الاندماج التكيفي، ونمذجة السياق القائمة على محول الرؤية (Vision Transformer)، واتصالات تخطي معززة للحواف لتحقيق دقة فائقة في التجزئة الدلالية لصور الاستشعار عن بعد.

Xiaona Peng, Chengyun Liu, Yaping Zhao, Zhenyan Wang, Zhong Chen, Zhenxue Chen2026-08-10
💻 computer science

A New Robust Scheme for Salt and Pepper Noise Filtering Using Fuzzy Cellular Automata

تقترح هذه الورقة مخطط ترشيحاً قوياً ثنائي المراحل يجمع بين الأتمتة الخلوية الضبابية ومقاييس تشابه جاكارد ومسافة هامينج للكشف عن ضوضاء الملح والفلفل وإزالتها بفعالية مع الحفاظ على تفاصيل الصورة الدقيقة والتفوق على التقنيات الحالية.

Mohammad Mehdi Piroozmandan2026-08-10
💻 computer science

Scene-aware Transformer encoder with Multi Instance Learning-guided Attention Mechanism for Anomaly Detection in Video Surveillance

تقترح هذه الورقة إطار عمل STAM، الذي يدمج التعلم التبايني من أجل تضمينات مدركة للمشهد مع مشفر محول موجه بواسطة انتباه التعلم متعدد الحالات، لمعالجة القيود السياقية والزمنية في كشف الشذوذ في الفيديو بفعالية وتحقيق دقة فائقة في مجموعات البيانات المرجعية.

Rifa Nizam Khan, Mohd. Amjad2026-08-10
💻 computer science

SemPix3D: Hybrid approach to generalized 3D aware image Synthesis and Generation using Conditional GAN

يقترح SemPix3D إطار عمل هجينًا يجمع بين حقل الإشعاع العصبي لتوليد خرائط تسمية مدركة ثلاثية الأبعاد ومولد يعتمد على StyleGAN لتخليق صور RGB متعددة المشاهد عالية الجودة ومتسقة، محققًا تحسينات كبيرة في التنوع ودرجات FID مقارنة بالطرق الحالية.

Souvik Bandyopadhyay, Tamal Pal2026-08-10
💻 computer science

Dynamic Lightweight YOLO for UAV-Based Forest Fire Detection\

تقترح هذه الورقة نموذج YOLOv8n محسناً وخفيف الوزن للكشف عن حرائق الغابات عبر الطائرات بدون طيار، يدمج التلافيف الديناميكية، ورأساً للكشف متعدد الوعي، وانتباهاً عبر مكاني لتعزيز دقة الأهداف الصغيرة وتقليل الإنذارات الكاذبة بشكل كبير مع الحفاظ على حجم مدمج مناسب للنشر الفوري على متن الطائرة.

Xiang Yin, Yinxia Xu, Ruofan Zhang2026-08-10
💻 computer science

SCEESR: Semantic-Control Edge Enhancement for Diffusion-Based Super-Resolution

تقترح الورقة البحثية إطار عمل SCEESR، وهو إطار عمل جديد يعتمد على الانتشار أحادي الخطوة لرفع دقة الصور، يستخدم آلية ControlNet للتوجيه الحواف الدلالي ودالة فقدان هجينة للموازنة بفعالية بين السلامة الهيكلية، والجودة الإدراكية، وسرعة الاستنتاج في عمليات ترميم الصور في العالم الحقيقي.

Yun Kai Zhuang2026-08-10
💻 computer science

Multi-scale Adaptive Framework for Dense Small Target Detection in SAR Images

تقترح هذه الورقة البحثية إطار عمل FMA-DETR، وهو إطار ترانسفورمر (Transformer) تكيُّفي يدمج شبكة صقل الميزات، ووحدة انتباه مكاني-قنوي متعدد المقاييس، ووحدة دمج تكيُّفية واعية بالتردد، للتغلب بفعالية على ضوضاء التبقّع وتعقيد الخلفية من أجل الكشف عالي الدقة للأهداف الصغيرة الكثيفة في صور رادار الفتحة الاصطناعية (SAR).

Chunming Tang, Zhuangzhi Ji2026-08-10
💻 computer science

Evaluating Large language models on Understanding Korean indirect Speech acts

تقيم هذه الدراسة قدرة نماذج اللغات الكبيرة المختلفة على فهم الأفعال الكلامية غير المباشرة في اللغة الكورية من خلال بناء مجموعة بيانات متخصصة واستخدام تقييمات آلية وبشرية، مما يكشف أنه بينما تتفوق النماذج المملوكة مثل Claude3-Opus على البدائل مفتوحة المصدر، إلا أن أيًا منها لا يضاهي بعد مستوى الكفاءة البشرية في تفسير النوايا المعتمدة على السياق.

Youngeun Koo, Jiwoo Lee, Dojun Park, Seohyun Park, Sungeun Lee2026-08-10
💻 computer science

EGDIS: Edge-Guided Document Image Steganography

تقترح الورقة البحثية طريقة EGDIS، وهي طريقة لإخفاء المعلومات في صور المستندات بتوجيه من الحواف، تستخدم خوارزمية "كاني" (Canny) تكيفية وشبكة دمج عبر الانتباه المتقاطع تعتمد على المحولات لدمج ميزات الحواف مع الصور الخام والرسائل السرية، مما يحقق أداءً فائقاً في التضمين وجودة بصرية عالية على مجموعات البيانات القياسية.

Shuqin Zhang, Kaiyu Li, Xueqing Wang, Jun Li, Yuanqing Xia2026-08-10