🤖 machine learning

Generalized Evidential Deep Learning: From a Bayesian Perspective

تؤسس هذه الورقة لأساس نظري بايزي رصين للتعلم العميق الدليلي (EDL)، وتقترح التعلم العميق الدليلي المعمم (GEDL)، وهو إطار عمل موحد يربط بشكل منهجي بين متغيرات التعلم العميق الدليلي القائمة مع إظهار أداء مماثل في التصنيف، وتقدير عدم اليقين، وكشف البيانات خارج التوزيع.

Yuanye Liu, Yibo Gao, Yuanyang Chen, Xiahai Zhuang2026-05-26
💻 computer science

StreamOV: Streaming Omni-Video Understanding via Evidence-Guided Memory and Response Triggering

يُعد StreamOV إطار عمل مبتكر للفهم التدفيقي للفيديو الشامل يعالج أوجه القصور في الطرق غير المتصلة (offline) عبر توظيف ذاكرة موجهة بالأدلة لإدارة السياق بكفاءة، ومحفز مدفوع بالحالة الخفية لتوليد استجابات استباقية، وهو ما تم التحقق من صحته بواسطة اختبار SOVBench المستحدث.

Ming Xie, Zizheng Huang, Xudong Tan, Chao Wang, Xiangyu Zeng, Wenxiao Wu, Tao Chen, Limin Wang, Yanwei Fu2026-05-26
💻 computer science

ARMA-C3: A Contrastive ARMA Convolutional Framework for Unsupervised and Semi-supervised Classification

تقدم الورقة البحثية ARMA-C3، وهو إطار عمل موحد للتعلم الرسومي غير الخاضع للإشراف وشبه الخاضع للإشراف يستفيد من التعلم التبايني وتنظيم قطع الرسم البياني (graph-cut) لتحقيق تصنيف قوي ودقيق للعقد في التصوير الطبي الحيوي، مما يعالج بفعالية تحديات مثل ندرة البيانات المصنفة وعدم توازن الفئات عبر مجموعات بيانات متنوعة للأمراض العصبية التنكسية والطبية.

VSS Tejaswi Abburi, Saurabh J. Shigwan, Nitin Kumar2026-05-26
💻 computer science

StreamChar: Long-Horizon Streaming Character Audio-Video Generation with Decoupled Orchestration

يُعد StreamChar إطار عمل للبث المباشر في الوقت الفعلي لتوليد الصوت والفيديو للشخصيات طويل الأمد، حيث يفصل بين التنسيق القائم على النماذج اللغوية الكبيرة وبين إزالة الضجيج المشترك للصوت والفيديو، ويستخدم مسار تقطير ثنائي المراحل مع محاذاة مدركة للتقدم وذاكرة كتل الغمر لتحقيق دقة عالية وتزامن واستقرار ضمن ميزانيات زمن انتقال صارمة.

Linrui Tian, Qi Wang, Bang Zhang2026-05-26
🤖 machine learning

Opportunistic Target Selection: Early Directional Commitment for Query-Efficient Black-Box Adversarial Attacks

تقدم هذه الورقة البحثية "الاختيار الانتهازي للهدف" (OTS)، وهو غلاف لهجوم عدائي بنظام الصندوق الأسود يتميز بكفاءة الاستعلام، حيث يحدد ديناميكيًا أكثر الفئات غير الحقيقية واعدة في وقت مبكر من مسار الهجوم، مما يحسن معدلات النجاح بشكل كبير ويقلل عدد الاستعلامات في هجمات البحث العشوائي، بينما يكشف عن عدم جدواه في سيناريوهات تقدير التدرج وفي النماذج المدربة خصيصًا لمواجهة الهجمات.

Florent Tariolle, Florian Yger2026-05-26
💬 NLP

CMAP: Cross-Modal Adaptive Prompting for Multi-Domain Task-Incremental Learning

يقدم CMAP إطار عمل فعال في المعلمات للتعلم التزايدي للمهام متعددة المجالات، والذي يستفيد من فضاء تضمين النص غير المستغل في نموذج CLIP لتوجيه المهام بمتانة، وتقدير الثقة، وتكييف المشفر، محققاً أداءً هو الأفضل في حالته على معيار MTIL دون بيانات خارجية أو معلومات عن هوية المهمة.

Sriram Mandalika2026-05-26
💻 computer science

DeCoDrift: Stabilizing Decoder Coupling in Closed-Loop Foundation Segmentation

تحدد هذه الورقة تعالج "انزياح اقتران فك التشفير" (decoder coupling drift)، وهو نمط فشل في التجزئة التأسيسية ذات الحلقة المغلقة حيث يتسبب التلقين التكراري في عدم محاذاة الانتباه، وذلك عبر تقديم DeCoDrift، وهو إطار عمل لا يتطلب إعادة تدريب يعمل على تثبيت ديناميكيات فك التشفير لتحسين جودة التجزئة دون الحاجة لإعادة التدريب.

H. M. Shadman Tabib, Md. Shamsuzzoha Bayzid, M Sohel Rahman2026-05-26
🤖 AI

Benchmarking Pathology Foundation Models for Spatial Domain Understanding

تقدم هذه الورقة SpaPath-Bench، وهو معيار مرجعي شامل على مستوى التمثيل يقيم نماذج التأسيس في علم الأمراض بناءً على قدرتها على التقاط العلاقات المكانية للأنسجة ذات المعنى من خلال صياغة تحديد النطاق المكاني كمهمة تشخيصية باستخدام بيانات صور الشرائح الكاملة والترانسكريبتوميات المكانية المزدوجة.

Bokai Zhao, Yiyang Zhang, Yuanchi Zhu, Hanqing Chao, Long Bai, Tai Ma, Minfeng Xu, Ming Song, Tianzi Jiang2026-05-26
🤖 machine learning

Concept Unlearning via Cross-Attention Activation Projection for Diffusion Models

تقترح الورقة البحثية طريقة PURE، وهي طريقة صياغة مغلقة لنسيان المفاهيم تعمل على إسقاط أوزان مفاتيح وقيم الانتباه المتقاطع بناءً على تمثيلات فضاء التنشيط لمحو المفاهيم المستهدفة بفعالية من نماذج الانتشار تحت المطالبات المعاد صياغتها والمطالبات العدائية مع الحفاظ على توليد المفاهيم المُحتفظ بها.

Saemi Moon, Suhyeon Jun, Seoyeon Lee, Dongwoo Kim2026-05-26
💻 computer science

Rethinking VLM Representation for VLA Initialization

تستقصي هذه الورقة الاستراتيجيات المثلى لتهيئة نماذج الرؤية واللغة والعمل (VLA) من نماذج الرؤية واللغة (VLM) سابقة التدريب، كاشفةً أن الحفاظ على تمثيل نموذج الرؤية واللغة الأصلي مع استخدام تدريب مرحلي قائم على تقنية "LoRA" مع التدريب المسبق ببيانات الروبوت يحقق الأداء الأكثر فعالية في تعلم العمل.

Weifeng Lin, Siyuan Huang, Hao Li, Tingwei Chen, Ruichuan An, Xinyu Wei, Jianbo Liu, Hongsheng Li2026-05-26