💻 computer science

Adapting Vision-Language Foundation Model for Next Generation Medical Ultrasound Image Analysis

تقترح هذه الورقة استراتيجية ضبط هجينة مبتكرة تسد الفجوة بين الأنماط بين النماذج التأسيسية للرؤية واللغة وبين الموجات فوق الصوتية الطبية من خلال دمج محول خفيف الوزن مع وحدات تصفية التردد وتقدير الضجيج، مما يحقق أداءً فائقاً، وكفاءة في البيانات، وقدرة على التعميم عبر مهام متنوعة للموجات فوق الصوتية دون تحديث الأوزان سابقة التدريب.

Jingguo Qu, Xinyang Han, Jia Ai, Juan Wu, Tong Zhao, Tonghuan Xiao, Sheng Ning, Yuqi Yang, Jing Qin, Ann Dorothy King, W (…)2026-05-05
⚡ electrical engineering

HiFi-Mamba: Dual-Stream W-Laplacian Enhanced Mamba for High-Fidelity MRI Reconstruction

تُعد HiFi-Mamba بنية ثنائية المسار مبتكرة تعزز إعادة بناء التصوير بالرنين المغناطيسي عالي الدقة من خلال دمج فك الارتباط الطيفي لـ W-Laplacian لنمذجة الميزات منخفضة وعالية التردد بشكل منفصل، وتوظيف مسار أحادي الاتجاه مبسط للقضاء على تكرار المسح، مما يجعلها تتفوق على النماذج الحالية القائمة على الشبكات العصبية الالتفافية (CNN)، والمحولات (Transformer)، ونماذج Mamba من حيث الدقة والكفاءة.

Hongli Chen, Pengcheng Fang, Yuxia Chen, Yingxuan Ren, Jing Hao, Fangfang Tang, Xiaohao Cai, Shanshan Shan, Feng Liu2026-05-05
💻 computer science

Scaling Sequence-to-Sequence Generative Neural Rendering

كاليدو (Kaleido) هو نموذج محول تدفق مستقيم موحد، يعتمد على فك التشفير فقط، يعامل الرندرة ثلاثية الأبعاد كمهمة توليد فيديو من تسلسل إلى تسلسل، مما يتيح توليد مناظر ثلاثية الأبعاد صريحة وبأداء متفوق من خلال الاستفادة من التدريب المسبق على فيديوهات واسعة النطاق، مع قدرة قوية على التوليد في حالة الصفر (zero-shot).

Shikun Liu, Kam Woh Ng, Wonbong Jang, Jiadong Guo, Junlin Han, Haozhe Liu, Yiannis Douratsos, Juan C. Pérez, Zijian Zhou (…)2026-05-05
💻 computer science

Geometry-Aware Scene Configurations for Novel View Synthesis

تقترح هذه الورقة إطار عمل مدركاً للهندسة لتوليد مناظر رؤية جديدة في المشاهد الداخلية المعقدة، يعمل على تحسين سعة التمثيل ووضع نقاط الرؤية الافتراضية من خلال الاستفادة من الأولويات الهندسية للتفوق على الترتيبات الموحدة للأسس في كل من جودة التصوير وكفاءة الذاكرة.

Minkwan Kim, Changwoon Choi, Young Min Kim2026-05-05
💻 computer science

Towards Accurate and Efficient Waste Image Classification: A Hybrid Deep Learning and Machine Learning Approach

تقترح هذه الدراسة إطار عمل هجينًا للتعلم العميق والتعلم الآلي لتصنيف صور النفايات، يتفوق على نهج التعلم الآلي والتعلم العميق المستقلين، محققًا دقة تقارب الكمال عبر مجموعات بيانات متعددة مع تقليل أبعاد الميزات وتكاليف الاستدلال بشكل كبير من أجل النشر القابل للتوسع.

Ngoc-Bao-Quang Nguyen, Tuan-Minh Do, Cong-Tam Phan, Thi-Thu-Hong Phan2026-05-05
🤖 AI

Deep Feature Optimization for Enhanced Fish Freshness Assessment

تقترح هذه الدراسة إطار عمل موحداً ثلاثي المراحل يجمع بين بنيات الرؤية العميقة المضبوطة بدقة، واستخراج الميزات متعدد المستويات، واختيار الميزات المتقدم لتحقيق دقة تبلغ (85.99%) في التقييم الآلي لطراوة الأسماك، وهو ما يتفوق بشكل كبير على الأساليب الحالية في مجموعة بيانات طراوة عيون الأسماك.

Phi-Hung Hoang, Nam-Thuan Trinh, Van-Manh Tran, Thi-Thu-Hong Phan2026-05-05
🤖 machine learning

GD-FPS: Growth-Driven Feedforward Parameter Selection for Efficient Fine-Tuning

تقترح الورقة البحثية طريقة GD-FPS، وهي طريقة لاختيار المعلمات تعتمد حصرياً على خلوها من التدرج وعلى التمرير الأمامي فقط، حيث تحدد بكفاءة المجموعات الفرعية المثلى للضبط الدقيق عبر قياس أحجام الأوزان الجوهرية مع نمو التنشيط النسبي، محققةً أداءً تنافسياً مع تقليل استهلاك الذاكرة وزمن الاستجابة بشكل كبير مقارنة بالنهج الحالية القائمة على التدرج.

Kenneth Yang, Wen-Li Wei, Jen-Chun Lin2026-05-05
💻 computer science

Combining Facial Videos and Biosignals for Stress Estimation During Driving

تقترح هذه الورقة إطار عمل لتقدير الإجهاد متعدد الوسائط أثناء القيادة يدمج ميزات الفيديو الوجهي القائمة على النموذج المورفولوجي ثلاثي الأبعاد مع الإشارات الفسيولوجية باستخدام الانتباه عبر الوسائط، مما يحسن دقة اكتشاف الإجهاد ومساحة تحت منحنى خصائص التشغيل (AUROC) بشكل كبير مقارنة باستخدام الإشارات الحيوية وحدها.

Paraskevi Valergaki, Vassilis C. Nicodemou, Iason Oikonomidis, Antonis Argyros, Anastasios Roussos2026-05-05
💻 computer science

Investigating Anthropometric Fidelity in SAM 3D Body

تتقصى هذه الورقة البحثية قصور نموذج (SAM 3D Body) في إعادة بناء الانحرافات الأنثروبومترية التفصيلية لفئات سكانية محددة، وتُعزي المشكلة إلى تأثير "الارتداد نحو المتوسط" الناتج عن تمثيله البارامتري منخفض الأبعاد والاشتراط الدلالي، بينما تقترح التمثيلات الهجينة والمواءمة القائمة على التدخل الطبي كمسارات لتحقيق تطبيقات طبية عالية الدقة.

Aizierjiang Aiersilan, Ruting Cheng, James Hahn2026-05-05
💻 computer science

Cross-Scale Pretraining: Enhancing Self-Supervised Learning for Low-Resolution Satellite Imagery for Semantic Segmentation

تقترح هذه الورقة مكون تقارب مكاني للتدريب المسبق ذاتي الإشراف يستفيد من صور الأقمار الصناعية عالية الدقة لتعزيز تعلم التمثيل وتحسين أداء التجزئة الدلالية في مهام متوسطة الدقة، متفوقة بذلك على النماذج المدربة على أي من الدقتين بمفردها.

John Waithaka, Gustave Bwirayesu, Moise Busogi2026-05-05