🤖 AI

Explainable Computer Vision Framework for Automated Pore Detection and Criticality Assessment in Additive Manufacturing

تقدم هذه الدراسة إطار عمل للرؤية الحاسوبية القابل للتفسير للتصنيع المضاف، والذي يكتشف المسام في الأحجام التصويرية ثلاثية الأبعاد ويستخدم التعلم الآلي مع تحليل SHAP للكشف عن أن قرب المسام من حدود العينة، وليس حجمها أو شكلها، هو العامل المهيمن في تحديد مدى خطورتها.

Akshansh Mishra, Rakesh Morisetty2026-02-05
🤖 AI

Vision Transformers for Zero-Shot Clustering of Animal Images: A Comparative Benchmarking Study

تُظهر هذه الدراسة أن نماذج "Vision Transformer" التأسيسية، ولا سيما نموذج "DINOv3"، عند دمجها مع تقنيات محددة لتقليل الأبعاد والتجميع، يمكنها تحقيق تجميع شبه مثالي للصور الحيوانية على مستوى الأنواع في وضع "الصفر المعرفة" (zero-shot)، مع الكشف أيضاً وبفعالية عن التباينات ذات المعنى البيئي داخل النوع الواحد مثل العمر والجنس دون الحاجة إلى تصنيف يدوي.

Hugo Markoff, Stefan Hein Bengtson, Michael Ørsted2026-02-05
🤖 machine learning

Benchmarking Bias Mitigation Toward Fairness Without Harm from Vision to LVLMs

تقدم هذه الورقة NH-Fair، وهو معيار موحد لتقييم العدالة دون ضرر عبر نماذج الرؤية والنماذج اللغوية البصرية الكبيرة، والذي يكشف أن الضبط الدقيق للبارامترات الفائقة لنماذج ERM القياسية غالباً ما يتفوق على العديد من طرق إزالة التحيز، بينما توفر استراتيجية تعزيز البيانات المركبة مساراً موثوقاً لتحسين تكافؤ المجموعات الفرعية دون التضحية بالمنفعة.

Xuwei Tan, Ziyu Hu, Xueru Zhang2026-02-05
💻 computer science

Beyond the Vehicle: Cooperative Localization by Fusing Point Clouds for GPS-Challenged Urban Scenarios

تقترح هذه الورقة إطار عمل لتحديد الموقع التعاوني للبيئات الحضرية التي تواجه تحديات في نظام تحديد المواقع العالمي (GPS)، مما يعزز الدقة والمتانة من خلال دمج بيانات السحابة النقطية من المركبة إلى المركبة ومن المركبة إلى البنية التحتية مع خوارزمية التموضع وبناء الخرائط الآني (SLAM) القائمة على التسجيل.

Kuo-Yi Chao, Ralph Rasshofer, Alois Christian Knoll2026-02-05
💻 computer science

Entropy Reveals Block Importance in Masked Self-Supervised Vision Transformers

تقدم هذه الورقة البحثية "Gardener"، وهي طريقة تقليم (pruning) أحادية الخطوة وخالية من البيانات، تستفيد من اعتلال المعلومات (information entropy) لأوزان الكتل مسبقة التدريب لتحديد وإزالة الكتل الزائدة في نماذج المحولات الرؤيوية ذات التعلم الذاتي المقنع (masked self-supervised vision transformers)، مما يحقق ضغطاً كبيراً للنموذج مع أدنى تأثير على الأداء في المهام اللاحقة.

Peihao Xiang, Kaida Wu, Ou Bai2026-02-05
💻 computer science

TiCLS : Tightly Coupled Language Text Spotter

يُعد TiCLS إطار عمل متكامل (end-to-end) لكشف نصوص المشاهد، حيث يحقق أداءً هو الأفضل في فئته من خلال الدمج الصريح للمعرفة اللغوية الخارجية المستمدة من نموذج لغوي مُدرب مسبقاً على مستوى الحروف، وذلك للتعرف بمتانة على حالات النصوص الغامضة أو المجزأة.

Leeje Jang, Yijun Lin, Yao-Yi Chiang, Jerod Weinman2026-02-05
💻 computer science

iSight: Towards expert-AI co-assessment for improved immunohistochemistry staining interpretation

تقدم هذه الورقة البحثية iSight، وهو إطار عمل للذكاء الاصطناعي متعدد المهام تم تدريبه على مجموعة بيانات HPA10M واسعة النطاق، والذي يتفوق على كل من النماذج التأسيسية وأطباء المسالك البولية في تفسير صبغات الكيمياء النسيجية المناعية، مع إثبات أن التقييم المشترك بين الخبير والذكاء الاصطناński يحسن دقة التشخيص واتساق التقييم بين المقيمين بشكل كبير.

Jacob S. Leiby, Jialu Yao, Pan Lu, George Hu, Anna Davidian, Shunsuke Koga, Olivia Leung, Pravin Patel, Isabella Tondi R (…)2026-02-05
💻 computer science

Context Determines Optimal Architecture in Materials Segmentation

تقدم هذه الورقة إطار تقييم عابر للأنماط لتجزئة صور المواد، يوضح كيف يعتمد الاختيار الأمثل للبنية التحتية على سياق التصوير، مع توفير إشارات الموثوقية وأدوات التفسير لتوجيه النشر والثقة في بيئات المجهر المتنوعة.

Mingjian Lu, Pawan K. Tripathi, Mark Shteyn, Debargha Ganguly, Roger H. French, Vipin Chaudhary, Yinghui Wu2026-02-05
💻 computer science

Adaptive 1D Video Diffusion Autoencoder

يقدم هذا البحث One-DVA، وهو مشفر تلقائي للفيديو يعتمد على تقنية الـ transformer، يتغلب على قيود النماذج الحالية من خلال توظيف الترميز القائم على الاستعلام مع إسقاط متغير الطول وفك تشفير قائم على الانتشار لتحقيق ضغط تكيفي وإعادة بناء عالية الجودة للفيديو.

Yao Teng, Minxuan Lin, Xian Liu, Shuai Wang, Xiao Yang, Xihui Liu2026-02-05
🤖 AI

ACIL: Active Class Incremental Learning for Image Classification

تقترح هذه الورقة إطار عمل ACIL، وهو إطار تعلم نشط جديد للتعلم التزايدي للفئات يستفيد من معايير عدم اليقين والتنوع لاختيار عينات غنية بالمعلومات لغرض التوسيم، مما يقلل بشكل كبير من تكاليف التوسيم مع التخفيف بفعالية من النسيان الكارثي.

Aditya R. Bhattacharya, Debanjan Goswami, Shayok Chakraborty2026-02-05