💻 computer science

A Non-Invasive Alternative to RFID: Self-Sufficient 3D Identification of Group-Housed Livestock

تقترح هذه الورقة نظاماً غير جراحي يعتمد على الرؤية باستخدام بيانات السحابة النقطية ثلاثية الأبعاد وإطار عمل شبه مُشرف ذاتي الكفاية يسمى TARA لتحديد هوية ماشية الأفراد بدقة في البيئات التي تُربى فيها في مجموعات دون الحاجة إلى علامات أذن تعمل بتقنية تحديد الهوية بموجات الراديو (RFID).

Shiva Paudel, TsungCheng Tsai, Dongyi Wang2026-04-27
💻 computer science

PASR: Pose-Aware 3D Shape Retrieval from Occluded Single Views

يُعد PASR (استرجاع الأشكال ثلاثية الأبعاد المدرك للوضعية) إطار عمل يعمل على تحسين استرجاع الأشكال ثلاثية الأبعاد من منظور واحد عبر تقطير المعرفة من نموذج أساسي ثنائي الأبعاد إلى مشفر ثلاثي الأبعاد، وتوظيف عملية تحسين "التحليل بالتوليد" في وقت الاختبار للبحث المشترك عن أفضل شكل ووضعية، مما يضمن المتانة ضد حالات الحجب.

Jiaxin Shi, Guofeng Zhang, Wufei Ma, Naifu Liang, Adam Kortylewski, Alan Vuile2026-04-27
💻 computer science

Generative Modeling of Neurodegenerative Brain Anatomy with 4D Longitudinal Diffusion Model

تقترح هذه الورقة إطار عمل توليديًا جديدًا قائمًا على الانتشار رباعي الأبعاد (4D) يعمل على نمذجة تشوهات مكانية-زمانية محافظة على الطوبولوجيا لتخليق مسارات تشريحية طولية واقعية ومتسقة سريريًا للدماغ من أجل نمذجة تطور الأمراض التنكسية العصبية.

Nivetha Jayakumar, Swakshar Deb, Bahram Jafrasteh, Qingyu Zhao, Miaomiao Zhang2026-04-27
💻 computer science

Long-tail Internet photo reconstruction

لمعالجة تحدي إعادة بناء المشاهد ثلاثية الأبعاد من صور الإنترنت الشحيحة والمشوشة، قدم المؤلفون MegaDepth-X، وهو مجموعة بيانات واسعة النطاق لإعادة البناء ثلاثي الأبعاد الكثيف، واستراتيجية أخذ عينات متخصصة تمكن نماذج التأسيس ثلاثية الأبعاد من تحقيق إعادة بناء قوية في سيناريوهات البيانات المنخفضة والطرفية دون فقدان القدرة على التعميم.

Yuan Li, Yuanbo Xiangli, Hadar Averbuch-Elor, Noah Snavely, Ruojin Cai2026-04-27
💻 computer science

VidHal: Benchmarking Temporal Hallucinations in Vision LLMs

تقدم هذه الورقة البحثية VidHal، وهو معيار مرجعي مبتكر مصمم لتقييم الهلوسة الزمنية في النماذج اللغوية البصرية الكبيرة من خلال توليد تعليقات توضيحية بمستويات متفاوتة من الهلوسة واقتراح مهمة ترتيب التعليقات التوضيحية لتمكين التقييم الدقيق لمحدودية النماذج.

Wey Yeh Choong, Yangyang Guo, Mohan Kankanhalli2026-04-24
💻 computer science

Beyond the Frame: Generating 360 Panoramic Videos from Perspective Videos

تقدم هذه الورقة إطار عمل مبتكرًا لتوليد فيديوهات بانورامية بزاوية 360 درجة واقعية ومتسقة مكانيًا وزمنيًا من مدخلات منظور قياسية، وذلك عبر الاستفوتادة من بيانات منسقة بزاوية 360 درجة وتوظيف عمليات مدركة للهندسة والحركة للتغلب على تحديات توسيع مجال الرؤية.

Rundong Luo, Matthew Wallingford, Ali Farhadi, Noah Snavely, Wei-Chiu Ma2026-04-24
🤖 machine learning

Analytical Softmax Temperature Setting from Feature Dimensions for Model- and Domain-Robust Classification

تقترح هذه الورقة طريقة خالية من التدريب للتصنيف القوي عبر اشتقاق درجة حرارة "softmax" مثلى بناءً على أبعاد الميزات، والتي يتم تنقيحها من خلال معاملات تجريبية وطبقة تطبيع الدفعات لاستقرار الأداء عبر النماذج ومجموعات البيانات المتنوعة.

Tatsuhito Hasegawa, Shunsuke Sakai2026-04-24
🤖 AI

Sharpness-Aware Minimization with Z-Score Gradient Filtering

تقترح هذه الورقة البحثية "الحد الأدنى الواعي بالحدة المفلتر بمعامل زد-سكور" (Z-Score Filtered Sharpness-Aware Minimization)، وهي طريقة تعزز القدرة على التعميم من خلال تطبيق تصفية قائمة على معامل زد-سكور للاحتفاظ فقط بمكونات التدرج الأكثر أهمية خلال خطوة الاضطراب، مما يؤدي إلى تقليل الضجيج وتحسين دقة الاختبار باستمرار عبر مختلف مجموعات البيانات والبنيات مقارنة بمتغيرات الحد الأدنى الواعي بالحدة الموجودة.

Vincent-Daniel Yun2026-04-24
🤖 machine learning

FunduSegmenter: Leveraging the RETFound Foundation Model for Joint Optic Disc and Optic Cup Segmentation in Retinal Fundus Images

تقدم هذه الورقة FunduSegmenter، وهو إطار عمل مبتكر يعمل على تكييف النموذج التأسيسي RETFound باستخدام وحدات متخصصة لتحقيق أداء هو الأفضل في حالته في عملية التجزئة المشتركة للقرص البصري والقعر البصري عبر مجموعات بيانات قاع العين المتنوعة، مما يظهر دقة وقدرة على التعميم متفوقة مقارنة بالنماذج المرجعية الحالية.

Zhenyi Zhao, Muthu Rama Krishnan Mookiah, Emanuele Trucco2026-04-24
🤖 machine learning

Efficient Multi-Source Knowledge Transfer by Model Merging

تقترح هذه الورقة إطار عمل للتعلم بنقل المعرفة متعدد المصادر يتسم بالقابلية للتوسع والدقة، حيث يقوم بتفكيك نماذج المصدر إلى مكونات من الرتبة الأولى عبر تحليل القيم المفردة (SVD)، وتجميع المكونات الأكثر بروزاً، وضبط القيم المفردة الرئيسية فقط بدقة ليتكيف بكفاءة مع مهام الهدف مع الحفاظ على المتانة.

Marcin Osial, Bartosz Wójcik, Bartosz Zieliński, Sebastian Cygert2026-04-24