🤖 AI

SPARC-Rad: A Multimodal Benchmark Dataset and Evaluation Pipeline for Spatial and Anatomical Reasoning in Radiology Vision-Language Models

تقدم الورقة البحثية SPARC-Rad، وهي مجموعة بيانات معيارية متعددة الوسائط تم تنسيقها يدويًا ومسار تقييم مصمم لتقييم قدرات الاستدلال المكاني والتشريحي لنماذج الرؤية واللغة الإشعاعية من خلال 300 زوج من (صورة-سؤال) مستمدة من دراسات تصويرية لمجموعات ضابطة سليمة.

Satvik Tripathi, Mustafa Ege Seker, Kristian Quevada, Ebubechukwu D Enwerem, Pratham Khandelwal, Emine Meltem, Bera Koca (…)2026-08-04
🧬 biology

What Carries the Signal in Pathology Foundation-Model Atlases? A Patient-Level Controlled Benchmark in Breast Cancer

تُرسخ هذه الدراسة معياراً مرجعياً مضبوطاً على مستوى المريض، يوضح أن تضمينات النماذج التأسيسية لعلم الأمراض، ولا سيما من نموذج UNI2، تتنبأ بشكل موثوق بدرجات البرامج الجينية الجزيئية المحجوبة في سرطان الثدي، بأداء ذي دلالة إحصائية يتجاوز سمات تكوين الأنسجة التقليدية.

Chimdi Walter Ndubuisi2026-08-04
🤖 machine learning

Rethinking Pretraining for Specialized Design Data: Evidence from the JONES-19 Cultural Design Dataset

تُثبت هذه الورقة أنه بالنسبة لمجالات التصميم المتخصصة مثل مجموعة بيانات JONES-19 الثقافية، فإن تدريب الشبكات العصبية الالتفافية من الصفر باستخدام استراتيجيات أخذ العينات المحلية يمكن أن يضاهي بفعالية أداء النماذج المدربة مسبقاً على ImageNet، مما يشير إلى أن مجموعات البيانات الأصغر والمختارة بعناية والتي تلتقط مبادئ تصميم محددة قد تكون أكثر فعالية من الاعتماد على التدريب المسبق الضخم للأغراض العامة.

Alexandros Haridis, Charles Zhou2026-08-04
🤖 machine learning

RadPRISM: Schema-stratified radiology-report supervision for concept-disentangled image representations and visual grounding

يُعد RadPRISM إطار عمل مبتكرًا للتدريب المسبق للرؤية واللغة، يقوم بمحاذاة صور الأشعة السينية للصدر مع مفاهيم محددة من قبل الأطباء في فضاءات فرعية بصرية مخصصة عبر إشراف مُقسّم طبقياً حسب المخطط، مما يحسن بشكل كبير من التصنيف صفري القدرة، والتأسيس البصري، والاسترجاع المفكك للمفاهيم مقارنة بالنماذج التقليدية ذات الفضاء المشترك.

Fabian Drexel, Marlene Fritzsche, Era Stambollxhiu, Miriam Kumpf, Lena Schmitzer, Lea Schumann, Jannik Kahmann, Friedric (…)2026-08-04
💻 computer science

MDWD: A Street-Level Dataset for Municipal Solid Waste Detection in Dense Urban Environments

تقدم هذه الورقة مجموعة بيانات النفايات المنزلية المالطية (MDWD)، وهي معيار مرجعي شامل على مستوى الشارع يضم 3,697 صورة عالية الدقة وأكثر من 11,000 نموذج مُصنف للنفايات المنزلية، وذلك لمعالجة الفجوة في موارد الكشف عن النفايات الصلبة البلدية وإرساء خطوط أساس أداء قابلة للتكرار لمختلف نماذج كشف الأشياء.

Andrea Filiberto Lucas, Mark Bugeja, Carl James Debono, Dylan Seychell2026-08-04
🤖 AI

Interpretability-Guided Soft Pruning of Attention Heads in Vision Transformers

تقدم هذه الورقة SAPER، وهو إطار عمل للتقليم الناعم الموجه بالتفسير، والذي يستفيد من التحليل الطيفي والتجميع الدلالي لرؤوس الانتباه لتقليل التكلفة الحسابية لنماذج "Vision Transformers" بكفاءة مع الحفاظ على دقة تصنيف عالية.

Kamil KsiąĊek, Piotr Suszyński, Michał Jan Włodarczyk, Jacek Tabor, Przemysław Biecek2026-08-04
🤖 AI

ORCA: ORgan-Centroid Aggregation for Training-Free 3D CT Visual Token Compression

تُعد ORCA طريقةً للضغط المرئي لرموز التصوير المقطعي المحوسب ثلاثي الأبعاد، وهي طريقة تعمل دون تدريب وتعمل بمبدأ "التوصيل والتشغيل"، حيث تستفيد من التجميع الموجه بالأعضاء والترميز الجيبي للمركز للحفاظ على المعلومات التشريحية، مما يقلل بشكل كبير من أعداد الرموز وتكاليف الاستدلال مع التفوق على النماذج المرجعية الحالية في مهام التنبؤ بالسمات وتوليد النصوص.

Renjie Liang, Zijian Xu, Jinqian Pan, Chengkun Sun, Zhengkang Fan, Shawn Li, You Qin, Mei Liu, Jie Xu2026-08-04
💻 computer science

The 1st AI Children Challenge

يقدم تحدي الذكاء الاصطناعي الأول للأطفال مجموعة بيانات مبتكرة لتسلسلات النقاط المفتاحية ثنائية الأبعاد للأطفال الذين تتراوح أعمارهم بين 3 و16 عاماً بهدف تطوير تطبيقات الرؤية الحاسوبية في الرعاية الصحية للأطفال من خلال معالجة التحليل الدقيق لسلوكيات المشي عبر مسارين معتمدين سريرياً: تسجيل درجة إدنبرة للمشي البصري وتصنيف أنماط المشي في حالات الشلل الدماغي التشنجي الثنائي.

Boyi Li, Yifan Shen, Houze Yang, Xu Cao, Guojun Yun, Li Gao, Turong Chen, Long Xu, Jianguo Cao, Meihuan Huang2026-08-04
🤖 AI

Artificial Intelligence for the Characterization of Particles and Fibers by Optical Microscopy

تقدم هذه الورقة إطار عمل لتقطير الذكاء الاصطناي، يقوم بتدريب نموذج طالب يعتمد على الرؤية فقط لتوليد تضمينات صور غنية دلالياً وقابلة للتفسير لتوصيف الجسيمات والألياف، وذلك من خلال إعادة بناء متجه معلم متعدد الوسائط يرمز للبيانات المرئية جنباً إلى جنب مع الإضاءة، والتكبير، والسياق المورفولوجي.

Simiao Sun, Kenneth Ng, Lynn Lee, Astrid Harth, Asami Odate, Aggelos Katsaggelos, Manuel Ballester Matito, Nicholas East (…)2026-08-04
🤖 AI

Boosting Generalizable Depth Estimation in Endoscopy by Mixture of Lightweight Experts and Intrinsic Image Alignment

تقترح هذه الورقة البحثية إطار عمل EndoMINI، وهو إطار عمل جديد للتعلم الذاتي لتقدير العمق في المناظير يتميز بالقدرة على التعميم، حيث يجمع بين خليط من الخبراء منخفضي الرتبة (MiLoRE) للتكيف الكفء في استخدام المعلمات، والمحاذاة الجوهرية للصورة (IIA) للتخفيف من تداخل الإضاءة، مما أظهر أداءً فائقاً في كل من معايير التعلم الخاضع للإشراف والتعلم الصفري.

Liangjing Shao, Beilei Cui, Yiming Huang, Changjing Liu, Hongliang Ren2026-08-04