⚡ electrical engineering

Training Deep Stereo Matching Networks on Tree Branch Imagery: A Benchmark Study for Real-Time UAV Forestry Applications

تقوم هذه الدراسة بمعايرة عشر شبكات مطابقة ستيريو عميقة على مجموعة بيانات جديدة لأغصان الأشجار من العالم الحقيقي مع أهداف مُولدة بواسطة DEFOM، حيث حددت BANet-3D كأعلى نموذج جودة وAnyNet كخيار الوقت الفعلي الوحيد لعمليات تقليم الغابات ذاتية القيادة بواسطة الطائرات بدون طيار.

Yida Lin, Bing Xue, Mengjie Zhang, Sam Schofield, Richard Green2026-02-24
💻 computer science

ApET: Approximation-Error Guided Token Compression for Efficient VLMs

تُعد ApET إطار عمل فعال لضغط الرموز (tokens) وخالٍ من آلية الانتباه لنماذج الرؤية واللغة، حيث يستفيد من أخطاء التقريب الناتجة عن إعادة البناء الخطي لتحديد الرموز البصرية الزائدة واستبعادها، مما يحقق وفراً كبيراً في الحوسبة مع الحفاظ على الأداء أو حتى تحسينه وضمان التوافق مع FlashAttention.

Qiankun Ma, Ziyao Zhang, Haofei Wang, Jie Chen, Zhen Song, Hairong Zheng2026-02-24
💻 computer science

BigMaQ: A Big Macaque Motion and Animation Dataset Bridging Image and 3D Pose Representations

تقدم الورقة البحثية BigMaQ، وهي مجموعة بيانات واسعة النطاق لقرود المكاك ريسوس المتفاعلة تتميز بإعادة بناء تفصيلية للوضعية والشكل ثلاثي الأبعاد عبر نماذج رمزية (avatars) منسوجة خاصة بكل فرد، مما يحسن بشكل كبير من أداء التعرف على حركات الحيوانات ويجسّر الفجوة بين التمثيلات القائمة على الصور وتمثيلات الوضعية ثلاثية الأبعاد.

Lucas Martini, Alexander Lappe, Anna Bognár, Rufin Vogels, Martin A. Giese2026-02-24
🤖 machine learning

Gradient based Severity Labeling for Biomarker Classification in OCT

تقترح هذه الورقة استراتيجية تعلم تبايني مبتكرة للصور الطبية تستبدل عمليات التعزيز العشوائية بملصقات شدة المرض المستمدة من تدرجات كشف الشذوذ لتحسين دقة تصنيف المؤشرات الحيوية في فحوصات التصوير المقطعي للتماسك البصري (OCT).

Kiran Kokilepersaud, Mohit Prabhushankar, Ghassan AlRegib, Stephanie Trejo Corona, Charles Wykoff2026-02-24
🤖 machine learning

Expanding the Role of Diffusion Models for Robust Classifier Training

تُثبت هذه الورقة أن الدمج الصريح للتمثيلات الداخلية المتنوعة والمتينة جزئياً لنماذج الانتشار كإشارة تعلم مساعدة، جنباً إلى جنب مع البيانات الاصطناعية، يعزز بشكل كبير من متانة وفك تشابك الميزات للمصنفات التي يتم تدريبها باستخدام التدريب الخصمي عبر مجموعات بيانات متعددة.

Pin-Han Huang, Shang-Tse Chen, Hsuan-Tien Lin2026-02-24
💻 computer science

Learning Positive-Incentive Point Sampling in Neural Implicit Fields for Object Pose Estimation

تقترح هذه الورقة طريقة لتقدير وضعية الأجسام بمتانة تجمع بين شبكة ضمنية تلافيفية متكافئة مع SO(3) واستراتيجية أخذ عينات النقاط ذات الحافز الإيجابي (PIPS) لاختيار نقاط استعلام مثالية ديناميكيًا، مما يتغلب على تحديات المناطق غير المرئية ويتفوق بشكل كبير على النهج الرائدة في السيناريوهات التي تنطوي على حالات احتجاب عالية، وأشكال جديدة، وضجيج شديد.

Yifei Shi, Boyan Wan, Xin Xu, Kai Xu2026-02-24
💻 computer science

Discover, Segment, and Select: A Progressive Mechanism for Zero-shot Camouflaged Object Segmentation

تقترح هذه الورقة إطار عمل "الاكتشاف-التجزئة-الاختيار" (DSS)، وهو آلية تدريجية لا تتطلب تدريبًا تجمع بين اكتشاف الأجسام القائم على الميزات، والتجزئة القائمة على نموذج SAM، والاختيار القائم على نماذج اللغات الكبيرة متعددة الوسائط (MLLM) لتحقيق أداء رائد في تجزئة الأجسام المموهة بنمط الصفر (zero-shot).

Yilong Yang, Jianxin Tian, Shengchuan Zhang, Liujuan Cao2026-02-24
💻 computer science

Token-UNet: A New Case for Transformers Integration in Efficient and Interpretable 3D UNets for Brain Imaging Segmentation

يقدم Token-UNet بنية هندسية ثلاثية الأبعاد لتقسيم صور الدماغ تتسم بالكفاءة والقابلية للتفسير، حيث تدمج وحدتي TokenLearner وTokenFuser لدمج نماذج المحولات (Transformers) ضمن شبكة UNet تلافيفية، محققةً درجات "Dice" فائقة مع تقليل بصمة الذاكرة، ووقت الاستدلال، وعدد المعلمات بشكل كبير مقارنة بـ SwinUNETR.

Louis Fabrice Tshimanga, Andrea Zanola, Federico Del Pup, Manfredo Atzori2026-02-24
🤖 machine learning

Closing the gap in multimodal medical representation alignment

تحدد هذه الورقة وجود فجوة النمط في التعلم متعدد الوسائط الطبي وتقترح إطار عمل محايد للنمط لسد هذه الفجوة، مما يؤدي إلى تحسين المحاذاة الدلالية، والاسترجاع عبر الوسائط، وكتابة التعليقات التوضيحية للصور بين الصور الإشعائية والنصوص السريرية.

Eleonora Grassucci, Giordano Cicchetti, Danilo Comminiello2026-02-24
💻 computer science

Decoupling Defense Strategies for Robust Image Watermarking

تقترح الورقة البحثية AdvMark، وهو إطار عمل جديد للضبط الدقيق على مرحلتين يعمل على فصل استراتيجيات الدفاع لتعزيز المتانة في آن واحد ضد الهجمات العدائية، والتشويه، وإعادة التوليد، مع الحفاظ على الدقة والنقاء البصري في العلامات المائية للصور القائمة على التعلم العميق.

Jiahui Chen, Zehang Deng, Zeyu Zhang, Chaoyang Li, Lianchen Jia, Lifeng Sun2026-02-24