🤖 AI

Cheap Probes Predict Expensive Training in 3D-CT Vision--Language Models

تقترح هذه الورقة طريقة فعالة من حيث التكلفة باستخدام مجسات رخيصة على تمثيلات المشفر المجمدة لترتيب وفحص تكوينات نماذج الرؤية واللغة ثلاثية الأبعاد (3D-CT) بكفاءة، محققةً ارتباطاً عالياً مع نتائج الضبط الدقيق المكلفة ومقللةً بشكل كبير من الموارد الحسابية المطلوبة لاختيار المعلمات الفائقة.

Renjie Liang2026-07-28
⚡ electrical engineering

Learning-based Hierarchical Tracheal Anatomy Understanding from Sparse Surgical Demonstration Annotations for Ultrasound Robots

تقدم هذه الورقة إطار عمل قائماً على التعلم يجمع بين عمود فقري لتحديد المواقع من نوع YOLOv8n ومفكك شفرة SAM2 متفرق ومُحسَّن بالتحفيز (prompt-optimized) لتحقيق تقسيم تشريحي للقصبة الهوائية يتسم بالمتانة والوقت الفعلي لعمليات بضع الرغامى الروبوتية الموجهة بالموجات فوق الصوتية، مما يتفوق بشكل كبير على نماذج U-Net المرجعية في كل من الدقة والتعميم مع تمكين التشغيل عن بُعد الروبوتي ذي الحلقة المغلقة.

Hiu Ching Cheung, Wenchao Yue, Zhengran Han, Mingcong Chen, Guanglin Cao, Hongbin Liu, Hongliang Ren2026-07-28
⚡ electrical engineering

Small, Bias-Free, Blind and Convolutional Denoiser: A compact ConvNeXt U-Net for blind Gaussian color-image denoising

تقدم الورقة البحثية نموذج BF-ConvUNeXt، وهو نموذج ConvNeXt U-Net مدمج وخالٍ من الانحياز يحقق إزالة الضجيج من الصور الملونة بنمط غاوسي الأعمى مع قدرة تعميم قوية عبر مستويات الضجيج وأداء تنافسي ضد النماذج الأكبر عبر الاستفادة من جذع غابور (Gabor stem) مجمد، وتوجيه هرم لابلات (Laplacian-pyramid routing)، وتجانس من الدرجة الأولى لتمكين نموذج واحد من التعامل مع نطاق واسع من مقاييس الضجيج.

Nikolas Markou2026-07-28
🔬 physics

Agentic Autoresearch for CT Reconstruction

تُظهر هذه الورقة أن عميلاً مستقلاً يعتمد على النماذج اللغوية الكبيرة يمكنه تنفيذ وتقييم ٢٦ طريقة لإعادة بناء الصور المقطعية بشكل مستقل، مما يكشف أن التصنيفات القائمة على بيانات مثالية وخالية من الضجيج تفشل في التنبؤ بالأداء تحت ظروف الضجيج الواقعية، وتسلط الضوء على ضرورة وجود معايير تقييم واقعية متعددة العوامل لقياس المتانة.

Andreas Maier, Lucas Kachelriess, Siming Bayer, Yixing Huang, Yan Xia, Amber Simpson, Moritz Zaiss2026-07-28
🤖 AI

Spatial-IQ: Deconstructing Spatial Intelligence via Hierarchical Capability Tests

تقدم هذه الورقة البحثية Spatial-IQ، وهو إطار تشخيصي هرمي يفكك الاستدلال المكاني إلى مهام فرعية إدراكية ومعرفية للكشف عن سلوكيات الاختصار في النماذج اللغوية الكبيرة متعددة الوسائط، وتُظهر أن التدريب باستخدام الإشراف بسلسلة الأفك والأدوات والتعلم المعزز على هذه المهام الفرعية يحسن بشكل كبير كلاً من الاتساق المكاني ودقة المهام الإجمالية.

Patrick Rim, Tom Long, Ekta Prashnani, Ruth Rosenholtz, Ben Boudaoud, Peter Xenopoulos, Alex Wong, Joohwan Kim, Jae-Hyun (…)2026-07-28
🤖 machine learning

Spectral-Aware Analytic Class-Incremental Learning for Long-Tailed Distributions

تقترح هذه الورقة البحثية "التصحيح الهندسي الطيفي" (GSR)، وهو إطار عمل للتنظيم الطيفي متباين الخواص يعمل على تضخيم القيم الذاتية المنهارة في مصفوفة "غرام" بشكل انتقائي للتغلب على عدم الاستقرار العددي لطرق التعلم المستمر التحليلي عند تطبيقها في سيناريوهات التعلم التزايدي للفئات ذات التوزيع غير المتوازن.

Quyen Tran, Hai Nguyen, Quan Dao, Zhuowei Li, Nam Le, Trung Le, Dimitris Metaxas2026-07-28
🤖 AI

HALLELUAI: A Hallucination-Aware AI System for Ultra-Realistic Image-to-Video Generation at Scale

إنَّ HALLELUAI هو نظام متكامل يضمن توليد فيديو من الصور بواقعية فائقة وجودة إنتاجية على نطاق واسع، وذلك عبر دمج وحدة إشراف مدركة للهلوسة مع إطار عمل لإعادة التوليد القائم على الوكلاء، لتنقيح المخرجات بشكل تكراري وضمان سلامة العلامة التجارية والدقة البصرية.

Aniket Sakpal, Yang Jiang, Rouzbeh Davoudi, Shayan Hassantabar, Mani Najmabadi2026-07-28
🤖 machine learning

Breaking the Synthetic-Real Domain Shortcut for Training-Free Generative Replay-based Class Incremental Learning

تقترح الورقة البحثية طريقة DREAM، وهي طريقة للتعلم التزايدي للفئات لا تتطلب تدريباً، تعمل على تخفيف مشكلة "الاختصار النطاقي" في إعادة التشغيل التوليدي من خلال توظيف تصحيح الفضاء الجزئي، والإسقاط المتعامد، وتنظيم النماذج الأولية المرتكزة على البيانات الحقيقية لتحقيق أداء رائد دون تخزين نماذج حقيقية.

Tao Zhang, Qixuan Fan, Yiyuan Liang, Yanjie Wang, Song Yan, Tian Tian, Jiahuan Zhou, Luxin Yan, Sheng Zhong, Xu Zou2026-07-28
💬 NLP

Similarity Is Not Logic: Factored Inference for Dual-Encoder Vision-Language Models

تحدد هذه الورقة أن نماذج الرؤية واللغة ذات المشفر المزدوج تفشل في الاستدلال التركيبي بسبب واجهة تشابه "حقيبة المفاهيم"، وتقترح طريقة لا تتطلب تدريباً تسمى LCSE (تحرير الدرجة المقيد بالمنطق) التي تفصل استخراج الأدلة عن تنفيذ القيود لتحسين الدقة المنطقية بشكل كبير مع الحفاظ على أداء الاسترجاع.

Sultan Alshehri, Zhantao Yang, Han Zhang, Marios Savvides2026-07-28
🤖 AI

Fashion-3DLR: A Controllable 3D Garment Generation Using Pairwise Fashion Elements for Intelligent Design

تقدم الورقة البحثية إطار عمل Fashion-3DLR، وهو إطار عمل مبتكر يستخدم محول انتشار لدمج ميزات الملابس (Garment Feature Fusion Diffusion Transformer) لدمج عناصر تصميم ثنائية الأبعاد متنوعة في الفضاء الكامن لتوليد ملابس ثلاثية الأبعاد عالية الجودة وقابلة للتحكم، قادرة على المحاكاة الفيزيائية والقياس الافتراضي، متجاوزةً بذلك الأساليب الحالية المتطورة.

Shenghao Yang, Hongtao Zhang, Yuhan Yi, Zhihao Tang, Zihao Cui, Lian Wen, Han Yan, Yuan Gao, Mingbo Zhao2026-07-28