💻 computer science

Radiative-Structured Neural Operator for Continuous and Extrapolative Spectral Super-Resolution

تقترح الورقة البحثية "المُعامل العصبي ذو البنية الإشعاعية" (RSNO)، وهو إطار عمل جديد للتعلم العميق يعيد بناء الصور فائقة الطيف من ملاحظات متعددة الأطياف عبر تعلم خرائط طيفية مستمرة تحت مقدمات إشعاعية، وتوظيف إسقاط متسق زاويًا لضمان الاتساق الفيزيائي والقضاء على تشوه الألوان.

Ziye Zhang, Bin Pan, Zhenwei Shi2026-03-10
💻 computer science

Yo'City: Personalized and Boundless 3D Realistic City Scene Generation via Self-Critic Expansion

تقدم هذه الورقة Yo'City، وهو إطار عمل وكيل يعتمد على النماذج الكبيرة للتخطيط الهرمي وحلقة توسع ذاتية النقد لتوليد مشاهد مدن ثلاثية الأبعاد واقعية، مخصصة، وغير محدودة، ومتماسكة مكانياً، متفوقاً بذلك على الأساليب الحالية الرائدة عبر مقاييس تقييم متعددة.

Keyang Lu, Sifan Zhou, Hongbin Xu, Gang Xu, Zhifei Yang, Yikai Wang, Zhen Xiao, Jieyi Long, Ming Li2026-03-10
🤖 machine learning

Shortcut Invariance: Targeted Jacobian Regularization in Disentangled Latent Space

تقترح هذه الورقة البحثية "ثبات الاختصار" (Shortcut Invariance)، وهي طريقة مستهدفة لتنظيم جاكوبي تعمل على تحسين التعميم خارج التوزيع عبر حقن ضوضاء متباينة المناحي في فضاء كامن مفكك لتسطيح حدود القرار على طول المحاور المتوافقة مع الاختصارات، مما يلغي الحاجة إلى تسميات اختصار صريحة أو عينات تدريب متضاربة.

Shivam Pal, Sakshi Varshney, Piyush Rai2026-03-10
🤖 machine learning

ForamDeepSlice: A High-Accuracy Deep Learning Framework for Foraminifera Species Classification from 2D Micro-CT Slices

تقدم هذه الدراسة ForamDeepSlice، وهو إطار عمل للتعلم العميق عالي الدقة يجمع بين مجموعة من نماذج ConvNeXt-Large وEfficientNetV2-Small مع مجموعة بيانات مقسمة بدقة على مستوى العينة لتحقيق دقة بنسبة 95.64% في تصنيف أنواع الفورامينيفيرا من شرائح التصوير المقطعي المحوسب الدقيق ثنائية الأبعاد، مع توفير لوحة تحكم تفاعلية للتعرف في الوقت الفعلي والمطابقة ثلاثية الأبعاد.

Abdelghafour Halimi, Ali Alibrahim, Didier Barradas-Bautista, Ronell Sicat, Abdulkader M. Afifi2026-03-10
💻 computer science

Are vision-language models ready to zero-shot replace supervised classification models in agriculture?

تقوم هذه الورقة البحثية بتقييم ٢٧ مجموعة بيانات زراعية وتجد أنه بينما تُظهر نماذج الرؤية واللغة (vision-language models) واعداً مع التلقين المقيد، إلا أنها لا تزال حالياً تؤدي أداءً أقل من النماذج المرجعية الخاضعة للإشراف مثل YOLO11، وليست جاهزة بعد لاستبدال النماذج المتخصصة كأنظمة تشخيص زراعية مستقلة.

Earl Ranario, Mason J. Earles2026-03-10
💻 computer science

ReMeDI: Refined Memory for Disambiguation of Identities with SAM3 in Surgical Segmentation

تقدم الورقة البحثية ReMeDI-SAM3، وهو امتداد لنموذج SAM3 لا يتطلب تدريباً، يعمل على تعزيز تجزئة الأدوات الجراحية في تنظير البطن من خلال تنفيذ تصفية ذاكرة مدركة للأهمية، والاستكمال البيني، وإعادة تحديد الهوية القائمة على الميزات للتغلب على تحديات مثل الانسدادات والحركة السريعة، محققاً تحسينات كبيرة في أداء التعلم الصفري (zero-shot) مقارنة بالطرق الحالية.

Valay Bundele, Mehran Hosseinzadeh, Hendrik P. A. Lensch2026-03-10
🤖 machine learning

ReDepth Anything: Test-Time Depth Refinement via Self-Supervised Re-lighting

يُعد Re-Depth Anything إطار عمل للتعلم الذاتي في وقت الاختبار يعمل على تعزيز تقدير العمق أحادي العين من خلال دمج النماذج التأسيسية مع نماذج الانتشار ثنائية الأبعاد واسعة النطاق لإجراء تحسين خالٍ من الملصقات عبر إعادة الإضاءة التوليدية وأخذ عينات تشتت الدرجة، محققاً بذلك نتائج رائدة دون تحسين مباشر لموتر العمق.

Ananta R. Bhattarai, Helge Rhodin2026-03-10
💻 computer science

VOIC: Visible-Occluded Integrated Guidance for 3D Semantic Scene Completion

تقدم هذه الورقة البحثية VOIC، وهو إطار عمل ثنائي فك التشفير مبتكر لإكمال المشهد الدلالي ثلاثي الأبعاد أحادي العدسة، والذي يستخدم استراتيجية استخراج تسمية المنطقة المرئية لفصل إدراك المنطقة المرئية عن استنتاج المنطقة المحجوبة، مما يؤدي إلى تخفيف تخفيف الميزات وتحقيق أداء رائد في المعايير القياسية.

Zaidao Han, Risa Higashita, Jiang Liu2026-03-10
🔬 physics

Efficient Vision Mamba for MRI Super-Resolution via Hybrid Selective Scanning

تقترح هذه الورقة البحثية "Efficient Vision Mamba"، وهو إطار عمل للتعلم العميق خفيف الحوسبة يجمع بين نماذج الحالة الفراغية الانتقائية متعددة الرؤوس والمسح الهجين لتحقيق أداء رائد في دقة تصوير الرنين المغناطيسي الفائقة مع تقليل المعلمات والحوسبة بشكل جذري مقارنة بالطرق الحالية.

Mojtaba Safari, Shansong Wang, Vanessa L Wildman, Mingzhe Hu, Zach Eidex, Chih-Wei Chang, Erik H Middlebrooks, Richard L (…)2026-03-10
💻 computer science

FLARE: Learning Future-Aware Latent Representations from Vision-Language Models for Autonomous Driving

يُعد FLARE إطار عمل مبتكر يُمكّن القيادة الذاتية من خلال الاستفادة من نماذج الرؤية واللغة سابقة التدريب عبر هدف تنبؤ ميزات مستقبلية ذاتي الإشراف وتحسين السياسة النسبي الجماعي، محققاً أداءً هو الأفضل في فئته على مقيść NAVSIM دون الحاجة إلى تعليقات لغوية كثيفة العمالة.

Chengen Xie, Chonghao Sima, Tianyu Li, Bin Sun, Junjie Wu, Zhihui Hao, Hongyang Li2026-03-10