💻 computer science

Don't Mind the Gaps: Implicit Neural Representations for Resolution-Agnostic Retinal OCT Analysis

تقترح هذه الورقة إطارين عمل غير مرتبطين بالدقة يعتمدان على التمثيلات العصبية الضمنية (INRs) لتمكين التحليل ثلاثي الأبعاد الكثيف لأحجام التصوير المقطعي للتماسك البصري (OCT) الشبكي متباين الخواص، وذلك من خلال إجراء استكمال بين مسحات B-scan باستخدام بيانات en-face وإنشاء أطلس شبكي قابل للتعميم، مما يتغلب على قيود النهج التقليدية ثنائية الأبعاد والنماذج ذات الدقة الثابتة.

Bennet Kahrs, Julia Andresen, Fenja Falta, Monty Santarossa, Heinz Handels, Timo Kepp2026-03-12
💻 computer science

Generating a Paracosm for Training-Free Zero-Shot Composed Image Retrieval

تقدم الورقة البحثية Paracosm، وهو أسلوب استرجاع صور مركب (Composed Image Retrieval) خالي من التدريب ويعمل بنظام الصفر (zero-shot)، يستفيد من النماذج اللغوية متعددة الوسائط لتوليد "صورة ذهنية" اصطناعية ونظائرها في قاعدة البيانات ضمن "باراكوزم" (paracosm) لسد الفجوة بين المجالات وتحقيق أداء رائد.

Tong Wang, Yunhan Zhao, Shu Kong2026-03-12
🤖 AI

DMS2F-HAD: A Dual-branch Mamba-based Spatial-Spectral Fusion Network for Hyperspectral Anomaly Detection

تقترح الورقة البحثية DMS2F-HAD، وهي شبكة تعتمد على بنية Mamba ثنائية المسار، تعمل على دمج الميزات المكانية والطيفية بكفاءة لتحقيق دقة تضاهي أحدث ما توصل إليه العلم وسرعات استدلال أسرع بشكل ملحوظ للكشف عن الشذوذ في الصور فائقة الطيف عبر مجموعات بيانات معيارية متعددة.

Aayushma Pant, Lakpa Tamang, Tsz-Kwan Lee, Sunil Aryal2026-03-12
🤖 AI

UniWeTok: An Unified Binary Tokenizer with Codebook Size 2128\mathit{2^{128}} for Unified Multimodal Large Language Model

يُعد UniWeTok مُجزئاً ثنائياً موحداً يتميز بكتيب رموز ضخم يبلغ 21282^{128}، وببنية هجينة تجمع بين الالتفاف والانتباه مع تفعيل SigLu، وإطار تدريب مبتكر ثلاثي المراحل يحقق أداءً هو الأفضل في فئته في توليد الصور والفهم متعدد الوسائط بتكاليف حوسبة أقل بكثير من النماذج الحالية.

Shaobin Zhuang, Yuang Ai, Jiaming Han, Weijia Mao, Xiaohui Li, Fangyikang Wang, Xiao Wang, Yan Li, Shanchuan Lin, Kun Xu (…)2026-03-12
💻 computer science

SIMSPINE: A Biomechanics-Aware Simulation Framework for 3D Spine Motion Annotation and Benchmarking

تقدم الورقة البحثية SIMSPINE، وهو إطار عمل للمحاكاة المدركة للميكانيكا الحيوية وأول مجموعة بيانات مفتوحة واسعة النطاق ذات تعليقات توضيحية ثلاثية الأبعاد متفرقة للعمود الفقري مستمدة من النمذجة العضلية الهيكلية، والذي يسد الفجوة بين الميكانيكا الحيوية والرؤية الحاسوبية لتمكين تقدير حركة العمود الفقري ثلاثية الأبعاد القابل لإعادة الإنتاج والمستند إلى أسس تشريحية، ويضع معايير مرجعية جديدة رائدة لتتبع العمود الفقري.

Muhammad Saif Ullah Khan, Didier Stricker2026-03-12
🤖 AI

PatchDenoiser: Parameter-efficient multi-scale patch learning and fusion denoiser for Low-dose CT imaging

يُعد PatchDenoiser إطار عمل خفيف الوزن وفعال في المعلمات يعتمد على الرقع متعدد المقاييس، حيث يعمل بفعالية على إزالة الضجيج من صور الأشعة المقطعية ذات الجرعة المنخفضة عبر موازنة كبح الضجيج مع الحفاظ على التفاصيل التشريحية، متفوقاً بذلك على أحدث طرق الشبكات العصبية الالتفافية (CNN) والشبكات التنافسية التوليدية (GAN) مع تقليل التكاليف الحسابية واستهلاك الطاقة بشكل كبير.

Jitindra Fartiyal, Pedro Freire, Sergei K. Turitsyn, Sergei G. Solovski2026-03-12
🤖 AI

AMLRIS: Alignment-aware Masked Learning for Referring Image Segmentation

تقترح هذه الورقة استراتيجية "التعلم المقنع الواعي بالمحاذاة" (AML)، وهي استراتيجية تدريب تعمل على تحسين تجزئة الصور المرجعية من خلال قياس محاذاة الرؤية واللغة على مستوى البكسل لحجب المناطق غير الموثوقة أثناء عملية التحسين، مما يحقق أداءً هو الأفضل في فئته دون تغييرات في البنية أو عبء إضافي عند الاستنتاج.

Tongfei Chen, Shuo Yang, Yuguang Yang, Linlin Yang, Runtang Guo, Changbai Li, He Long, Chunyu Xie, Dawei Leng, Baochang (…)2026-03-12
💻 computer science

HG-Lane: High-Fidelity Generation of Lane Scenes under Adverse Weather and Lighting Conditions without Re-annotation

تقترح الورقة البحثية HG-Lane، وهو إطار عمل للتوليد عالي الدقة ينشئ معياراً مرجعياً جديداً يتكون من 30,000 صورة للمسارات في ظل ظروف جوية وإضاءة سيئة دون الحاجة لإعادة التوسيم، مما يحسن بشكل كبير أداء نماذج اكتشاف المسارات الحالية في هذه البيئات الصعبة.

Daichao Zhao, Qiupu Chen, Feng He, Xin Ning, Qiankun Li2026-03-12
📊 statistics

Unbalanced Optimal Transport Dictionary Learning for Unsupervised Hyperspectral Image Clustering

تقترح هذه الورقة طريقة غير خاضعة للإشراف لتجميع الصور فائقة الطيف، تعمل على تحسين تعلم قاموس فضاء وايسرستاينين الحالي عبر استخدام مراكز باريترا لـ "وايسرستاين" غير المتوازنة لتعلم تمثيل متين منخفض الأبعاد، مما يؤدي إلى التخفيف من مشكلات ضبابية الفئات والحساسية تجاه القيم المتطرفة والضجيج.

Joshua Lentz, Nicholas Karris, Alex Cloninger, James M. Murphy2026-03-12
💬 NLP

Video-Based Reward Modeling for Computer-Use Agents

تقدم هذه الورقة نموذج مكافأة فيديو التنفيذ (ExeVRM)، وهو إطار عمل قابل للتوسع ومستقل عن النموذج يستفيد من مجموعة بيانات جديدة مكونة من 53 ألف فيديو-مهمة-مكافأة وتقليم الرموز الزماني والمكاني لتقييم مسارات وكلاء استخدام الكمبيوتر بدقة من فيديوهات التنفيذ، متفوقاً بذلك على النماذج المملوكة الرائدة في التنبؤ بنجاح المهمة.

Linxin Song, Jieyu Zhang, Huanxin Sheng, Taiwei Shi, Gupta Rahul, Yang Liu, Ranjay Krishna, Jian Kang, Jieyu Zhao2026-03-12