🤖 AI

WeNLEX: Weakly Supervised Natural Language Explanations for Multilabel Chest X-ray Classification

تقدم هذه الورقة WeNLEX، وهو إطار عمل تحت إشراف ضعيف يولد تفسيرات لغوية طبيعية أمينة ومعقولة لتصنيف صور الأشعة السينية للصدر متعددة الملصقات من خلال محاذاة ميزات الصور مع النصوص المولدة وتقارير الأطباء المتطابقة مع التوزيع، مما يتطلب حداً أدنى من البيانات الحقيقية مع تحسين أداء التصنيف والتكيف مع الجماهير المتنوعة.

Isabel Rio-Torto, Jaime S. Cardoso, Luís F. Teixeira2026-03-20
💻 computer science

ProCal: Probability Calibration for Neighborhood-Guided Source-Free Domain Adaptation

يعالج ProCal أوجه القصور الناجمة عن الاعتماد المفرط على تشابه التنبؤ في تكيف النطاق الخالي من المصدر من خلال إدخال آلية تعاونية ثنائية النموذج تعمل ديناميكيًا على معايرة التنبؤات القائمة على الجوار لموازنة الاحتفاظ بمعرفة المصدر مع التكيف مع النطاق المستهدف، مما يقلل من نسيان المعرفة وفرط التخصيص للضوضاء.

Ying Zheng, Yiyi Zhang, Yi Wang, Lap-Pui Chau2026-03-20
🤖 AI

Points-to-3D: Structure-Aware 3D Generation with Point Cloud Priors

تقدم الورقة البحثية Points-to-3D، وهو إطار عمل قائم على الانتشار يستفيد من مسبقات السحابة النقطية المتاحة بسهولة لتحقيق توليد ثلاثي الأبعاد متفوق وقابل للتحكم في الهندسة عبر استبدال تهيئة الضجيج بمدخلات مهيكلة واستخدام شبكة ترميم هيكلي متخصصة داخل نموذج TRELLIS.

Jiatong Xia, Zicheng Duan, Anton van den Hengel, Lingqiao Liu2026-03-20
💻 computer science

VesselTok: Tokenizing Vessel-like 3D Biomedical Graph Representations for Reconstruction and Generation

يُعد VesselTok إطار عمل مبتكر يعمل على ترميز الرسوم البيانية الطبية الحيوية المعقدة وعالية الكثافة مكانياً إلى تمثيلات كامنة مدمجة باستخدام نقاط الخط المركزي وأنصاف أقطار وهمية، مما يتيح إعادة بناء قوية، ونمذجة توليدية، ونقلاً فعالاً إلى المهام اللاحقة عبر مختلف البنى التشريحية.

Chinmay Prabhakar, Bastian Wittmann, Tamaz Amiranashvili, Paul Büschl, Ezequiel de la Rosa, Julian McGinnis, Benedikt Wi (…)2026-03-20
🤖 machine learning

PromptHub: Enhancing Multi-Prompt Visual In-Context Learning with Locality-Aware Fusion, Concentration and Alignment

يُعد PromptHub إطار عمل مبتكر يعزز التعلم السياقي البصري عبر استبدال دمج الرقع المحدود بنهج مدرك للمحلية يدمج الأولويات المكانية، وأهداف التدريب التكميلية، وتعزيز البيانات لتحقيق أداء فائق، ومتانة، وعالمية عبر مهام رؤية متنوعة.

Tianci Luo, Jinpeng Wang, Shiyu Qin, Niu Lian, Yan Feng, Bin Chen, Chun Yuan, Shu-Tao Xia2026-03-20
🤖 AI

Translating MRI to PET through Conditional Diffusion Models with Enhanced Pathology Awareness

تقدم هذه الورقة البحثية PASTA، وهو إطار عمل جديد لنماذج الانتشار الشرطية يولد صور PET اصطناعية عالية الجودة ومدركة للمرض من فحوصات الرنين المغناطيسي باستخدام بنية ثنائية الأذرع واتساق تبادل الدورة، مما يحسن بشكل كبير أداء تشخيص مرض الزهايمر مقارنة بالرنين المغناطيسي وحده.

Yitong Li, Igor Yakushev, Dennis M. Hedderich, Christian Wachinger2026-03-20
💻 computer science

GHOST: Fast Category-agnostic Hand-Object Interaction Reconstruction from RGB Videos using Gaussian Splatting

يُعد GHOST إطار عمل سريعاً ومستقلاً عن الفئات، يستخدم تقنية التغطية الغاوسية ثنائية الأبعاد (2D Gaussian Splatting) وخسائر هندسية ومحاذاة مبتكرة لإعادة بناء تفاعلات اليد مع الأشياء بشكل متسق فيزيائياً وقابل للتحريك من فيديوهات RGB أحادية، محققاً دقة وكفاءة تبلغ أحدث المعاياي في هذا المجال مقارنة بالطرق السابقة.

Ahmed Tawfik Aboukhadra, Marcel Rogge, Nadia Robertini, Abdalla Arafa, Jameel Malik, Ahmed Elhayek, Didier Stricker2026-03-20
💻 computer science

Unleashing the Power of Simplicity: A Minimalist Strategy for State-of-the-Art Fingerprint Enhancement

تقدم هذه الورقة نهجاً بسيطاً ومفتوح المصدر لتحسين بصمات الأصابع يتكون من طرق الترشيح السياقي والأسالهم القائمة على التعلم، والتي تتفوق على التقنيات المعقدة والمتطورة في الدقة والكفاءة، لا سيما بالنسبة للصور منخفضة الجودة.

Raffaele Cappelli2026-03-20
💻 computer science

SwiftTailor: Efficient 3D Garment Generation with Geometry Image Representation

يُعد SwiftTailil إطار عمل جديداً ذا مرحلتين يحقق أداءً رائدًا وكفؤًا في توليد الملابس ثلاثية الأبعاد من خلال توحيد الاستدلال على أنماط الخياطة وتوليد الشبكات عبر تمثيل صورة هندسية مدمجة، مما يقلل وقت الاستنتاج بشكل كبير مقارنة بالطرق الحالية.

Phuc Pham, Uy Dieu Tran, Binh-Son Hua, Phong Nguyen2026-03-20
🤖 AI

Em-Garde: A Propose-Match Framework for Proactive Streaming Video Understanding

يُعد Em-Garde إطار عمل مبتكر يعزز الفهم الاستباقي للفيديو المتدفق من خلال فصل الفهم الدلالي عن الإدراك عبر محلل مقترحات موجه بالتعليمات ووحدة مطابقة خفيفة الوزن، مما يحل معضلة الكفاءة والدقة في نماذج الفيديو اللغوية الكبيرة الحالية.

Yikai Zheng, Xin Ding, Yifan Yang, Shiqi Jiang, Hao Wu, Qianxi Zhang, Weijun Wang, Ting Cao, Yunxin Liu2026-03-20