🤖 machine learning

Low-Rank Ternary Adaptation for Fine-Tuning Transformers

تقترح هذه الورقة البحثية "التكيف الضربي الثلاثي"، وهي طريقة جديدة ذات رتبة منخفضة تتيح الضبط الدقيق الفعال للمحولات الثلاثية من خلال تمثيل تحديثات الأوزان المنفصلة عبر مصفوفات ثلاثية صغيرة، مما يحافظ على النطاق الثلاثي ويسمح بالدمج المباشر دون إعادة تكميم مع استعادة الأداء بشكل كبير عبر النماذج اللغوية ونماذج الرؤية.

Alexandru-Dragos Manolache, Yunqiang Li, Jan van Gemert2026-08-26
💻 computer science

KLTNet: Learning Sparse Feature Tracking for Robust and Accurate Monocular Visual-Inertial Odometry

تقترح الورقة البحثية KLTNet، وهو متتبع سمات متفرق خفيف الوزن وقائم على التعلم يستبدل خوارزمية KLT الكلاسيكية في أنظمة التقدير الملاحي البصري-القصوري عبر الجمع بين بنية من الخشن إلى الناعم ومن الكثيف إلى المتفرق وأوزان ثقة متباينة الخواص لتحقيق تقدير حالة قوي ودقيق وفي الوقت الفعلي، لا سيما في البيئات ذات القوام المنخفض أو الحركة العالية.

Renbiao Jin, Danping Zou, Wenxian Yu2026-08-26
💻 computer science

Towards Reliable AI-Based Histological Staining: A Systematic Study of Scaling and Uncertainty in Unpaired Generative Models

تقدم هذه الورقة تقييماً معيارياً منهجياً لستة نماذج توليدية غير خاضعة للإشراف لصبغ تليف الكبد الافتراضي، كاشفةً أن الجودة الإدراكية، والدقة المحددة للمهمة، واليقين المعرفي هي مقاييس مستقلة تتطلب تقييماً مشتركاً لضمان موثوقية الترجمة النسيجية القائمة على الذكاء الاصطيري.

Qasim Siddiqui, Adrian Friebel, Maiju Myllys, Zaynab Hobloss, Daniela Gonzalez, Ahmed Ghallab, Stefan Hoehme2026-08-26
💻 computer science

On-Policy Self-Distillation in Diffusion Models

تقدم الورقة البحثية DiffusionOPSD، وهو إطار عمل للتقطير الذاتي القائم على السياسة (on-policy) يقوم بتحويل المكافآت على مستوى الصورة إلى أهداف إشراف وسيطة صريحة لنماذج الانتشار، محققاً أداء محاذاة فائقاً ومكاسب كبيرة في كفاءة التدريب مقارنة بالطرق الحالية.

Wei Zhou, Xiongwei Zhu, Lingdong Kong, Bo Chen, Lei Zhang, Yongyuan Liang, Xiaoxia Hou, Ye Tian, Xian Sun, Yingshuo Wang (…)2026-08-26
💻 computer science

Game2World Engine: Unlocking In-the-Wild Gameplay Videos for World Model Training

تقدم هذه الورقة البحثية Game2World، وهو إطار عمل شامل يتميز بـ G2WEngine لاستخراج أصول واجهة المستخدم ونموذج GameCleaner لإزالة واجهة العرض (HUD) بدون أقنعة، والذي يحول فيديوهات أسلوب اللعب الخام إلى بيانات تدريب عالية الجودة وخالية من واجهة المستخدم، مما يعزز بشكل كبير أداء نموذج العالم.

Wenxuan Shen, Dongna Jin, Dongping Chen2026-08-26
🤖 AI

Deep Learning Super Resolution for Satellite Cloud Mask Downscaling

تتناول هذه الورقة تحدي الحصول على أرصاد سحابية مستمرة وعالية الدقة من خلال تقديم مجموعة بيانات جديدة عابرة للمستشعرات (SEVMOD-CM) ونموذجين للتعلم العميق (SpatialCNN وSpatialGAN) نجحا في خفض دقة منتجات قناع السحب من SEVIRI إلى دقة MODIS مع تعزيز مكاني بمقدار 4 أضعاف، متفوقين بذلك على الاستيفاء ثنائي الكعب التقليدي.

Angelos Georgakis, Valentina Kanaki, Giorgos Giannopoulos, Stella Girtsou, Ioannis Kontogiorgakis, Charalampos Kontoes (…)2026-08-26
💻 computer science

TorchMorph: CUDA-accelerated Morphological Transforms

تُعد TorchMorph امتداداً خفيف الوزن لـ PyTorch، مرخصاً بموجب رخصة MIT، يوفر مجموعة شاملة من 22 من العمليات المورفولوجية وتحويلات المسافة المتسارعة بواسطة CUDA مع واجهة برمجة تطبيقات متوافقة مع SciPy، مما يتيح معالجة الأشكال بكفاءة وإنتاجية عالية مباشرة داخل حلقات تدريب الـ GPU.

Kai Zhao2026-08-26
💻 computer science

MoE-based Feature Adapter for Prompt-free Binary Coronary Artery Segmentation in X-ray Angiography

تقترح هذه الورقة محول ميزات يعتمد على خليط من الخبراء (MoE) خالٍ من التلقين، مبني على محولات "Vision Transformer" ذات الكفاءة في المعلمات، لتحقيق تقسيم ثنائي قوي ومعمم للشرايين التاجية في تصوير الأوعية بالأشعة السينية عبر تحسين ميزات الأوعية بشكل تكيفي مع إدارة التكاليف الحسابية.

Lin Xi, Yingliang Ma2026-08-26
💻 computer science

EMFE: A lightweight, explainable machine learning framework for malaria cell classification

تقدم هذه الورقة إطار عمل EMFE، وهو إطار تعلم آلي خفيف الوزن وقابل للتفسير يحقق تصنيفاً دقيقاً لخلايا الملاريا على مستوى المريض ومن الناحية الإحصائية باستخدام خمس ميزات هندسية وخوارزميات كلاسيكية، مما يوفر بديلاً فعالاً من الناحية الحسابية لنماذج التعلم العميق مع تحديد حدوده بوضوح.

Md Abdullah Al Kafi, Walayat Hussain, Mousumi Karmakar, Sumit Kumar Banshal, Ahmed Al Marouf2026-08-26
🤖 machine learning

LAION-BVD: A 10-Million-Hour Open Video Dataset for Multimodal Pre-training

تقدم الورقة البحثية LAION-BVD، وهو مجموعة بيانات مفتوحة ضخمة تضم 80 مليون فيديو (10 ملايين ساعة) مع تعليقات توضيحية مُولدة اصطناعياً، مما يتيح التدريب المسبق متعدد الوسائط بأسلوب الحالة الراهنة عبر مهام الفيديو والصوت والنص-الصورة.

Andreas Hochlehnert, Marianna Nezhurina, Mehdi Cherti, Andrej Radonjic, Thaddäus Wiedemer, Christoph Schuhmann, Romain B (…)2026-08-26