💻 computer science

Weakly Supervised Concept Learning with Class-Level Priors for Interpretable Medical Diagnosis

تقدم هذه الورقة "متنبئ المفاهيم الموجه بالأولويات" (PCP)، وهو إطار عمل للتعلم الخاضع للإشراف الضعيف يستفيد من أولويات المفاهيم على مستوى الفئة والانتظام لتمكين تشخيص طبي موثوق وقابل للتفسير دون الحاجة إلى تعليقات توضيحية مكلفة للمفاهيم، متفوقاً بشكل كبير على النماذج المرجعية ذات التعلم الصفري مع مضاهاة النماذج الخاضعة للإشراف الكامل.

Md Nahiduzzaman, Steven Korevaar, Alireza Bab-Hadiashar, Ruwan Tennakoon2026-03-05
🤖 AI

Improving Multi-View Reconstruction via Texture-Guided Gaussian-Mesh Joint Optimization

تقترح هذه الورقة إطاراً موحداً للتحسين المشترك السلس بين "Gaussian" والشبكة (mesh)، والذي يعمل في آن واحد على تحسين هندسة الشبكة وألوان الرؤوس باستخدام توجيه النسيج والرندرة القابلة للتفاضل لتحقيق عمليات إعادة بناء ثلاثية الأبعاد عالية الجودة مناسبة لمهام التحرير اللاحقة.

Zhejia Cai, Puhua Jiang, Shiwei Mao, Hongkun Cao, Ruqi Huang2026-03-05
🤖 machine learning

NeuCLIP: Efficient Large-Scale CLIP Training with Neural Normalizer Optimization

يُعد NeuCLIP إطار عمل تحسين مبتكر يعيد صياغة فقدان التباين (contrastive loss) باستخدام التحليل المحدب والمتغير لاستبدال مُقدِّرات المُطَبِّع لكل عينة غير الفعالة بشبكة عصبية مدمجة، مما يُمكِّن من تدريب نماذج CLIP واسعة النطاق بدقة وكفاءة أكبر عبر مجموعات بيانات تتراوح من ملايين إلى مليارات العينات.

Xiyuan Wei, Chih-Jen Lin, Tianbao Yang2026-03-05
💻 computer science

Skullptor: High Fidelity 3D Head Reconstruction in Seconds with Multi-View Normal Prediction

يسد "سكالبتور" (Skullptor) الفجوة بين إعادة البناء الفعالة من صورة واحدة وبين التصوير المساحي متعدد الرؤى عالي الدقة، وذلك عبر الجمع بين نموذج للتنبؤ بالأسطح الطبيعية يعتمد على الانتباه عبر الرؤى وبين تحسين التصيير العكسي، لتحقيق إعادة بناء ثلاثية الأبعاد مفصلة للرأس في ثوانٍ معدودة مع تقليل المتطلبات المتعلقة بالكاميرا والحوسبة.

Noé Artru, Rukhshanda Hussain, Emeline Got, Alexandre Messier, David B. Lindell, Abdallah Dib2026-03-05
💻 computer science

EvalMVX: A Unified Benchmarking for Neural 3D Reconstruction under Diverse Multiview Setups

تقدم هذه الورقة البحثية EvalMVX، وهي مجموعة بيانات شاملة من العالم الحقيقي تضم 25 جسماً مع نماذج شبكية (meshes) حقيقية متوافقة تم التقاطها تحت ظروف إضاءة وزوايا رؤية متنوعة، لإنشاء معيار موحد للتقييم والمقارنة الكمية لطرق الاستعادة الخاصة بالرؤية متعددة المناظر العصبية (neural multiview stereo)، والستيريوفوتومتري (photometric stereo)، والاستعادة من الاستقطاب (shape-from-polarization).

Zaiyan Yang, Jieji Ren, Xiangyi Wang, zonglin li, Xu Cao, Heng Guo, Zhanyu Ma, Boxin Shi2026-03-05
🤖 AI

ITO: Images and Texts as One via Synergizing Multiple Alignment and Training-Time Fusion

تقترح الورقة البحثية إطار عمل ITO، الذي يعزز التدريب المسبق التبايني بين الصور والنصوص من خلال دمج المحاذاة المتعددة متعددة الوسائط مع وحدة دمج خفيفة الوزن وغير مستخدمة أثناء الاستدلال لتقليل الفجوات بين الوسائط والتفوق على النماذج المرجعية الحالية عبر مختلف المعايير.

HanZpeng Liu, Yaqian Li, Zidan Wang, Shuoxi Zhang, Zonglin Zhao, Zihao Bo, Rinyoichi Takezoe, Kaiwen Long, Kun He2026-03-05
🤖 machine learning

Toward Early Quality Assessment of Text-to-Image Diffusion Models

تقدم هذه الورقة البحثية Probe-Select، وهي وحدة إضافية تتنبأ بجودة الصورة النهائية من تنشيطات إزالة الضجيج المبكرة لتمكين الإنهاء المبكر للعينات غير الواعدة، مما يقلل تكاليف أخذ العينات بنسبة تزيد عن 60% مع تحسين جودة الصور المحتفظ بها في عملية توليد الصور من النصوص.

Huanlei Guo, Hongxin Wei, Bingyi Jing2026-03-05
💻 computer science

TRACE: Task-Adaptive Reasoning and Representation Learning for Universal Multimodal Retrieval

يقدم TRACE إطار عمل مبتكر للاسترجاع متعدد الوسائط الشامل يوحد بين الاستدلال التوليدي وتعلم التمثيل التمييزي من خلال توليد وضغط آثار سلسلة الأفك "Chain-of-Thought"، محققاً بذلك أداءً هو الأفضل في فئته عبر الاستدلال المستقل المتكيف مع المهام والقدرة القوية على النقل في ظروف الصفر (zero-shot transferability).

Xiangzhao Hao, Shijie Wang, Tianyu Yang, Tianyue Wang, Haiyun Guo, Jinqiao Wang2026-03-05
💻 computer science

Deep Sketch-Based 3D Modeling: A Survey

تقدم هذه الورقة مسحاً شاملاً للنمذجة ثلاثية الأبعاد القائمة على الرسم العميق (DS-3DM) من خلال تقديم فضاء التصميم المبتكر MORPHEUS، الذي يصنف التطورات الأخيرة ضمن إطار عمل (مدخل-نموذج-مخرج) لتسليط الضوء على القيود الحالية وتحديد الفرص المستقبلية متعددة التخصصات لتعزيز إنشاء المحتوى ثلاثي الأبعاد المتمحور حول المستخدم، والقابل للتحكم، والغني بالمعلومات.

Alberto Tono, Jiajun Wu, Gordon Wetzstein, Iro Armeni, Hariharan Subramonyam, James Landay, Martin Fischer2026-03-05