💻 computer science

Frozen Brain-MRI Foundation Models Are Site Fingerprints

تكشف هذه الورقة أن نماذج التأسيس لصور الرنين المغناطيسي للدماغ المجمدة تشفر بطبيعتها معلومات موقع الاستحواذ كبصمة مهيمنة وقابلة للفك خطياً تتفوق غالباً على المتغيرات السريرية، مما يشكل مخاطر جسيمة في العزو ويخلق مقايضة بين إزالة انحياز الموقع والحفاظ على دقة التجزئة التشريحية.

Saman Rahbar2026-08-12
🤖 machine learning

UniMod: Enhancing Multi-Modal Medical Diagnosis through Cross-Modality and Within-Modality Alignment

يُعد UniMod إطار عمل جديد للتشخيص الطبي متعدد الوسائط يعمل على الحد من تعلم الاختصار عبر فرض تنبؤات مستقلة لكل وسيط إلى جانب المحاذاة بين الوسائط وداخل الوسيط الواحد، مما يحقق أداءً هو الأفضل في فئته في مهام التصنيف أحادي التسمية ومتعدد التسميات عبر مجموعات بيانات متنوعة.

Zijian Gu, Weikai Lin, Shuang Zhou, Zihan Chen, Song Wang2026-08-12
💻 computer science

From Detection to Understanding: TAR and TAR-Bench for Multi-Task Traffic Anomaly Reasoning

تقدم هذه الورقة البحثية TAR وTAR-Bench، وهما مجموعة بيانات ومعيار شاملان يشتملان على 44,040 تعليقاً من نوع "سلسلة الأفكار" (chain-of-thought) عبر 10 مهام لتدريب وتقييم نماذج اللغة والفيديو على الاستنتاج متعدد المهام لحالات الشذوذ المروري بما يتجاوز مجرد الكشف البسيط.

Han Zhang, Yilin Zhao, Zaid Pervaiz Bhat, Zheng Tang, Varun Praveen, Vidya N. Murali, David C. Anastasiu, Tomasz Kornuta2026-08-12
💻 computer science

A second-order theory of texture for depth from focus

تقدم هذه الورقة نظرية قائمة على بصريات الموجة تثبت أن الأسطح التي تبدو خالية من الملمس تظهر حتى هي ملمساً من الدرجة الثانية بسبب التبقع الذاتي، والذي يمكن تعزيزه باستخدام مرشحات طيفية ضيقة النطاق لتحسين إعادة بناء العمق من التركيز السلبي بشكل كبير.

Sreekar Ranganathan, Ioannis Gkioulekas2026-08-12
🔬 physics

Lesion-Aware Adaptive Fourier Neural Operator for CT-to-PSMA PET Synthesis in Prostate Cancer

تقدم الورقة البحثية LAFNO، وهو مؤثر عصبي فوري (Fourier neural operator) تكيفي مدرك للآفات يستخدم قنوات بديلة مشتقة من التصوير المقطعي المحوسب (CT) تتسم بالكفاءة للكثافة والنسيج المحلي لتخليق صور PSMA-PET من فحوصات التصوير المقطعي المحوسب، مما يحسن بشكل كبير من دقة نشاط الورم وقابلية تكرار الخصائص الراديومية مقارنة بنماذج الفقد العالمي القياسية مع الحفاظ على جودة عالية لصورة الحجم الكامل.

Rashmi Bhaskara, Waleed M. Almutairi, Matthew Gopaulchan, Maram Musaad Alqurashi, Francis Asamoah, Alex Ocana, Clinton D (…)2026-08-12
💻 computer science

DynaPPI: A Large-scale Dynamic Protein Dataset for AI-driven Advances in Protein Interactomics

تقدم هذه الورقة البحثية DynaPPI، وهي مجموعة بيانات واسعة النطاق لمسارات الديناميكا الجزيئية تلتقط التكوين الديناميكي للمعقدات البروتينية، لتمكين نماذج الانتشار من تعلم عمليات الارتباط والتنبؤ بدقة بهياكل تجمعات البروتين متعددة السلاسل غير المعروفة.

Jiabao Wei, Zilong Geng, Yuze Wang, Jianjun Li, Ning Ding, Bowen Zhou, Bing Zhang, Zhiyuan Ma2026-08-12
💻 computer science

Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation

يُعد "Stream Forcing" إطار تدريب موحداً يعالج عدم التطابق بين التدريب والاستدلال في توليد الفيديو المتدفق عبر بناء مسار تدريب مستمر وإدخال خوارزميات المعايرة المشتركة وأخذ العينات الارتباطية الزمنية، مما يحسن جودة التوليد بشكل كبير ويمكّن من الاستقراء القوي للفيديوهات طويلة المدى بصفر محاولات (zero-shot).

Yueting Zhu, Yuehao Song, Kaicheng Zhang, Bao Tang, Shaoyu Chen, Qian Zhang, Wenyu Liu, Xinggang Wang2026-08-12
💻 computer science

Towards Color-Faithful Low-Light Image Enhancement via Adaptive Color Debiasing and Saturation Rectification

تقترح هذه الورقة البحثية إطار عمل CAGE، وهو إطار عمل مبتكر يتميز بإزالة انحياز اللون التكيفي وتصحيح التشبع المتناغم مع النطاق اللوني ضمن فضاء لوني أسطواني لتحقيق استعادة لونية دقيقة وتحسين الجودة البصرية في تعزيز الصور ذات الإضاءة المنخفضة.

Zhichen Yang, Rui Xu, Yuzhen Niu, Fusheng Li, Hui Da, Ri Cheng2026-08-12
💻 computer science

SafeCap: Improving LVLM Safety with Image Captioning Reinforcement Learning

يُعد SafeCap إطار عمل للتعلم المعزز يعمل على تعزيز سلامة النماذج اللغوية البصرية الكبيرة ضد هجمات الاختراق عبر تدريب النماذج على توليد أوصاف صور ذات صلة بالسلامة توجه النموذج اللغوي الكبير المجمد نحو قرارات متوافقة، مما يجعله يتفوق على أساليب محاذاة السلامة الحالية مع الحفاظ على المنفعة البصرية.

Caoyuan Ma, Wenpu Liu, Weichu Xie, Tian Gu, Shilei Zhao, Lingxi Min, Shuai Dong, Yuqi Xu, Ji Zhao, Ziyue Wang, Wenzheng (…)2026-08-12
💻 computer science

Dynamic Context Adapters: Efficiently Infusing History into Vision-and-Language Models

تقدم الورقة البحثية "المُكيِّف السياقي الديناميكي" (Dynamic Context Adapter - DCA)، وهي طريقة مبتكرة تقوم بكفاءة بحقن السياق التاريخي المضغوط في نماذج الرؤية واللغة سابقة التدريب باستخدام ذاكرة ثابتة الحجم، مما يتغلب على القيود الحسابية وقيود الذاكرة الناتجة عن دمج الإطارات المباشر، مع تحسين الأداء بشكل كبير في مهام اتخاذ القرار المتسلسلة طويلة المدى.

Yuhang Song, Bor-Jiun Lin, Jiaxu Liu, Te-Chuan Chiu, Anh Nguyen, Chun-Yi Lee2026-08-12