💻 computer science

GhostPoint: Self-Supervised Representation Learning by Hallucinating Occluded LiDAR Structure

يُعد GhostPoint إطار عمل للتعلم الخاضع للإشراف الذاتي يعمل على تحسين الكشف عن الأجسام ثلاثية الأبعاد من السحب النقطية لليدار (LiDAR) عبر استحضار ميزات كامنة في المناطق المحجوبة من خلال تمدد المجلدات (voxels) الخاصة بالنماذج، مما يتغلب على انحياز السطح المرئي في الطرق الحالية ويحقق أداءً رائدًا، لا سيما في حالات المسح المتناثر وسيناريوهات البيانات المحدودة الملصقات.

Mohamed Abdelsamad, Bin Yang, Michael Ulrich, Miao Zhang, Yakov Miron, Alexandru Paul Condurache, Abhinav Valada2026-08-17
🤖 machine learning

Style or Signature? Artist-Disjoint Evaluation of Style Classification in Frozen Vision Embeddings

تجادل هذه الورقة بأن التقييمات القياسية لتصنيف الأسلوب في التمثيلات البصرية المجمدة تكون متضخمة بفعل التعرف على الفنان بدلاً من الفهم الأسلوبي الحقيقي، مما يثبت أن بروتوكولاً منفصلاً للفنانين يكشف عن انخفاضات كبيرة في الأداء وعدم اتساق في المتانة عبر الحركات الفنية.

Rory Ashton2026-08-17
💻 computer science

MagnifiQ: Patch-aware Text Guided Progressive Upscaling for High-Resolution Image Restoration

إن MagnifiQ هو إطار عمل مبتكر لترميم الصور يحقق استعادة صور بدقة 4K عالية من خلال الجمع بين تكييف قابل للتوسع يعتمد على الالتفاف لنماذج الانتشار من النص إلى الصورة، واستراتيجية ترقية تدريجية، وتوجيه نصي خاص بكل رقعة لضمان التماسك العالمي والتفاصيل المحلية الحادة.

Mahesh Reddy, Yashesh Savani, Antoine Mercier, Hong Cai, Fatih Porikli, Guillaume Berger2026-08-17
🤖 machine learning

Continual Distillation Learning for Rehearsal-Free Class-Incremental Learning via Decoupled Prompting

تقدم هذه الورقة البحثية "التعلم بالتقطير المستمر المنفصل" (D-CDL)، وهو إطار عمل مبتكر للتعلم المتزايد للفئات بدون استرجاع، يعمل على تحسين نقل المعرفة من نماذج "Vision Transformers" الأكبر إلى الأصغر عبر فصل التكيف الخاص بالمهمة عن التقطير صراحةً من خلال مطالبات تقطير المعرفة العالمية والمستمرة.

Qifan Zhang, Yunhui Guo, Yu Xiang2026-08-14
💻 computer science

Shortest-Path Decomposition for Foliage-Robust 3D Tree Modeling and Above-Ground Biomass Estimation from Point Clouds

تقدم هذه الورقة طريقة تفكيك للمسار الأقصر مدفوعة بالطوبولوجيا، تعمل على إعادة بناء هياكل الأشجار ثلاثية الأبعاد بشكل قوي وتقدير الكتلة الحيوية فوق الأرض من السحب النقطية في ظروف وجود الأوراق، وذلك عبر استعادة التسلسل الهرمي للتفرع مباشرة دون الحاجة إلى فصل صريح بين الأوراق والخشب.

Di Wang, Shi Li2026-08-14
💻 computer science

Generalizable Operating Room Expert with Multimodal Enhancement

تقدم الورقة البحثية OR-Expert، وهو إطار عمل رؤية-لغوي ضخم يحقق أداءً هو الأفضل في مجاله في الاستدلال المكاني ثلاثي الأبعاد داخل غرف العمليات باستخدام الصور اللونية (RGB) فقط، وذلك من خلال توليد ودمج ميزات العمق الزائف، والتجزئة، والسحابة النقطية داخلياً دون الحاجة إلى مستشعرات خارجية أو بيانات توضيحية.

Peiqi He, Zhenhao Zhang, Yixiang Zhang, Jiaxin Liu, Xiongjun Zhao, Shaoliang Peng2026-08-14
💻 computer science

CityRiSE: Reasoning Urban Socio-Economic Status in Large Vision-Language Models via Reinforcement Learning

تقدم الورقة البحثية إطار عمل CityRiSE، وهو إطار عمل مبتكر يستفيد من التعلم المعزز مع بيانات متعددة الوسائط منسقة بعناية ومكافآت قابلة للتحقق لتعزيز قدرة النماذج اللغوية البصرية الكبيرة على أداء استدلال دقيق وقابل للتفسير وقابل للتعميم للتنبؤ بالوضع الاجتماعي والاقتصادي الحضري عبر سياقات متنوعة وغير مرئية.

Tianhui Liu, Hetian Pang, Xin Zhang, Jie Feng, Pan Hui, Yong Li2026-08-14
🤖 machine learning

RadarGen: Automotive Radar Point Cloud Generation from Cameras

يعد RadarGen إطار عمل يعتمد على الانتشار، يقوم بتخليق سحب نقاط رادارية واقعية للسيارات من صور كاميرا متعددة الزوايا عبر الاستفادة من الإشارات البصرية والدلالية والحركية المتوافقة مع منظور الرؤية المحيطية (BEV) لسد الفجوة بين المجالات في عمليات المحاكاة التوليدية متعددة الوسائط.

Tomer Borreda, Fangqiang Ding, Sanja Fidler, Shengyu Huang, Or Litany2026-08-14
💻 computer science

AI for Mycetoma Diagnosis in Histopathological Images: The MICCAI 2024 Challenge

تقدم هذه الورقة نظرة عامة على تحدي MICCAI 2024 mAIcetoma، الذي نجح في تطوير تشخيص المايسيتوما المدعوم بالذكاء الاصطناعي من خلال إشراك فرق عالمية لتطوير نماذج التعلم العميق التي حققت دقة عالية في تقسيم حبيبات المايسيتوما وتصنيف أنواع المايسيتوما من الصور النسيجية المرضية باستخدام مجموعة بيانات MyData الموحدة.

Hyam Omar Ali, Sahar Alhesseen, Lamis Elkhair, Adrian Galdran, Ming Feng, Zhixiang Xiong, Zengming Lin, Kele Xu, Liang H (…)2026-08-14
🤖 machine learning

SpaRRTa: A Synthetic Benchmark for Evaluating Spatial Intelligence in Visual Foundation Models

تقدم هذه الورقة SpaRRTa، وهو معيار مرجعي اصطناعي مصمم لتقييم قدرات الاستدلال المكاني لنماذج التأسيس البصري من خلال اختبار قدرتها على تحديد المواضع النسبية للأجسام، مما يكشف عن تفاوتات كبيرة في الوعي المكاني للنماذج الحالية ويوجه التطوير المستقبلي.

Turhan Can Kargin, Wojciech Jasiński, Adam Pardyl, Bartosz Zieliński, Marcin Przewięźlikowski2026-08-14