🤖 machine learning

Global Offshore Wind Infrastructure: Deployment and Operational Dynamics from Dense Sentinel-1 Time Series

تقدم هذه الورقة مجموعة بيانات عالمية جاهزة للتحليل من السلاسل الزمنية الكثيفة لبيانات رادار الفتحة الاصطناعية (SAR) من القمر الصناعي "سنتينل-1" للفترة من 2016 إلى 2025، وتضم أكثر من 14 مليون حدث وعلامات مرجعية، لتمكين المراقبة والتحليل عاليي الدقة الزمنية لنشر البنية التحتية لطاقة الرياح البحرية وديناميكيات تشغيلها.

Thorsten Hoeser, Felix Bachofer, Claudia Kuenzer2026-04-23
💻 computer science

DeVI: Physics-based Dexterous Human-Object Interaction via Synthetic Video Imitation

تُعد DeVI إطار عمل مبتكر يُمكّن من التحكم في التفاعل البشري مع الأشياء ببراعة ومحاكاة الواقع الفيزيائي عبر الاستفادة من الفيديوهات الاصطناعية المشروطة بالنصوص ومكافأة تتبع هجينة بين الثلاثية والأبعاد، مما يحقق تعميماً صفرياً (zero-shot generalization) على أشياء غير مرئية دون الحاجة إلى عروض توضيحية حركية ثلاثية الأبعاد عالية الجودة.

Hyeonwoo Kim, Jeonghwan Kim, Kyungwon Cho, Hanbyul Joo2026-04-23
💻 computer science

Personalized Embodied Navigation for Portable Object Finding

تقدم هذه الورقة مناهج التخطيط المدرك للنقل (TAP) التي تعامل الملاحة المتجسدة المخصصة للبحث عن الأشياء المحمولة كمسألة تعلم عادات، مما يمكّن الوكلاء من التزامن مع الأهداف التي يحركها البشر ويحسن معدلات النجاح بشكل كبير في كل من البيئات الديناميكية المحاكية والواقعية.

Vishnu Sashank Dorbala, Bhrij Patel, Amrit Singh Bedi, Dinesh Manocha2026-04-22
💻 computer science

EPS: Efficient Patch Sampling for Video Overfitting in Deep Super-Resolution Model Training

تقترح هذه الورقة طريقة EPS، وهي طريقة فعالة لأخذ عينات الرقع (patch sampling) تستخدم ميزات مكانية-زمانية قائمة على تحويل جيب التمام المقطع (DCT) منخفضة التعقيد لاختيار أكثر رقع الفيديو غنىً بالمعلومات بشكل تكيفي من أجل الإفراط في ضبط (overfitting) نماذج الدقة الفائقة العميقة، مما يقلل تكاليف التدريب بشكل كبير ويسرع العملية مع الحفاظ على جودة إعادة بناء عالية.

Yiying Wei, Hadi Amirpour, Jong Hwan Ko, Christian Timmerer2026-04-22
🤖 AI

3D Foundation Model for Generalizable Disease Detection in Head Computed Tomography

تقدم هذه الورقة البحثية نموذج FM-CT، وهو نموذج تأسيسي ثلاثي الأبعاد يعتمد على التعلم الذاتي تم تدريبه على أكثر من 360,000 صورة مقطعية غير معلمة للرأس، والذي يتفوق بشكل كبير على النماذج الحالية في اكتشاف الأمراض المتنوعة عبر مجموعات البيانات الداخلية والخارجية، لا سيما عندما تكون البيانات المعلمة نادرة.

Weicheng Zhu, Haoxu Huang, Huanze Tang, Rushabh Musthyala, Boyang Yu, Long Chen, Emilio Vega, Thomas O'Donnell, Seena De (…)2026-04-22
💻 computer science

A Leaf-Level Dataset for Soybean-Cotton Detection and Segmentation

تقدم هذه الورقة مجموعة بيانات متاحة للجمهور وعالية الدقة على مستوى الأوراق، تحتوي على 640 صورة تضم أكثر من 12,000 ورقة من الصويا والقطن مُعنونة، صُممت لمعالجة تحديات اكتشاف وتجزئة الأوراق المتداخلة في الحقول الزراعية المعقدة لتطبيقات مثل الرش الانتقائي لمبيدات الأعشاب.

Thiago H. Segreto, Juliano Negri, Paulo H. Polegato, João Manoel Herrera Pinheiro, Ricardo V. Godoy, Marcelo Becker2026-04-22
🤖 machine learning

COMODO: Cross-Modal Video-to-IMU Distillation for Efficient Egocentric Human Activity Recognition

تقدم هذه الورقة البحثية COMODO، وهو إطار عمل للتقطير ذاتي الإشراف عبر الأنماط ينقل المعرفة الدلالية من الفيديو إلى مستشعرات وحدة القياس بالقصور الذاتي (IMU) دون الحاجة إلى تسميات، مما يتيح التعرف على الأنشطة البشرية من منظور الشخص الأول بكفاءة عالية، وبما يحافظ على الخصوصية، وبأداء عالٍ على الأجهزة القابلة للارتداء.

Baiyu Chen, Wilson Wongso, Zechen Li, Yonchanok Khaokaew, Hao Xue, Flora Salim2026-04-22
🤖 machine learning

RESFL: An Uncertainty-Aware Framework for Responsible Federated Learning by Balancing Privacy, Fairness and Utility

يُعد RESFL إطار عمل مدركاً لعدم اليقين للتعلم الاتحادي، يقوم بحل المقايضة بين الخصوصية والعدالة في اكتشاف الأشياء من خلال دمج فك الارتباط التنافسي للخصوصية مع التجميع القائم على الشبكات العصبية الدليلية لتعزيز فائدة النموذج، وتقليل مخاطر استنتاج العضوية، وتقليل التحيز الديموغرافي في آن واحد.

Dawood Wasif, Terrence J. Moore, Jin-Hee Cho2026-04-22
🤖 AI

GAIR: Location-Aware Self-Supervised Contrastive Pre-Training with Geo-Aligned Implicit Representations

تقترح الورقة البحثية إطار عمل GAIR، وهو إطار تعلم ذاتي الإشراف جديد مدرك للموقع يوسع نماذج "Vision Transformers" باستخدام الاستيفاء المحلي العصبي الضمني لتوليد تمثيلات جغرافية مكانية مستمرة وعالية الدقة، مما يتيح أداءً فائقاً عبر مختلف المهام الجغرافية المكانية مقارنة بالنماذج التأسيسية الحالية.

Zeping Liu, Ni Lao, Zhangyu Wang, Junfeng Jiao, Gengchen Mai2026-04-22
💬 NLP

OmniGen2: Towards Instruction-Aligned Multimodal Generation

يُعد OmniGen2 نموذجاً مفتوح المصدر، متوافقاً مع التعليمات ومتعدد الوسائط، يستخدم بنية ذات مسارين بمعلمات منفصلة لتحقيق أداء رائد في مهام تحويل النص إلى صورة، وتحرير الصور، والتوليد السياقي القائم على الموضوع، مع الحفاظ على القدرات النصية الحالية.

Chenyuan Wu, Pengfei Zheng, Ruiran Yan, Shitao Xiao, Xin Luo, Yueze Wang, Wanli Li, Xiyan Jiang, Yexin Liu, Junjie Zhou (…)2026-04-22