🤖 AI

Beyond Static Anchors: Bounded Prototype Conditioning for Language-Free Medical Anomaly Detection

يُعد ReCAP إطار عمل للكشف عن الشذوذ الطبي الخالي من اللغة، والذي يستبدل المرتكزات الثابتة القائمة على نموذج CLIP بنماذج أولية بصرية مشروطة بالمدخلات وذاكرة غير معلمية، محققاً أداءً فائقاً في إعدادات التعلم الصفري والتعلم القليل بينما يقلل زمن انتقال الاستدلال بشكل كبير.

Yibo Wan, Jinyu Cai, Seekiong-Ng2026-08-04
💻 computer science

Reconstruction-Shift Discrimination via Mask-Guided Latent Diffusion for Medical Anomaly Detection

تقترح هذه الورقة نموذج الانتشار الموجه بالقناع التمييزي (DMD)، وهو إطار عمل غير مُشرف جديد للكشف عن الشذوذ الطبي يجمع بين تمييز إزاحة إعادة البناء والتحديد القائم على المتبقيات لتحقيق أداء رائد عبر مختلف أنماط التصوير الطبي.

Yibo Wan, Jinyu Cai, Yunhe Zhang, Yi Bin, See-kiong Ng2026-08-04
💻 computer science

Structured Proxy Features for Multimodal NSCLC Survival Prediction from Pretreatment CT

تُثبت هذه الورقة أن تعزيز التنبؤ ببقاء مرضى سرطان الرئة غير صغير الخلايا (NSCLC) متعدد الوسائط باستخدام سمات وسيطة مهيكلة مشتقة من "أوتوماتون خلوي" مُعامل بالراديوميات، وذلك لالتقاط التفاعلات بين عدم التجانس الورمي والمورفولوجيا، يحسن الأداء بشكل كبير في مجموعة بيانات (Lung1) مقارنة بالنهج التقليدية للراديوميات والتعلم العميق.

Huu Phong Nguyen, Delower Hossain, Ehsan Saghapour, Zhandos Sembay, Jake Y. Chen2026-08-04
💻 computer science

DocPO: Advancing Document Policy Optimization via Tailored Step-Aware Rewards

تقدم هذه الورقة DocPO، وهو إطار عمل لتحسين سياسة المستندات يستخدم آلية تبريد مدركة للخطوات (Step-Aware Annealing) مبتكرة لتعزيز المكافآت القائمة على المرجع، مما يتغلب على ضعف الإشارات التمييزية لمقاييس مسافة التحرير التقليدية ويحسن بشكل كبير أداء التعلم التعزيزي من أجل تحليل مستندات عالي الدقة.

Yunhao Wang, Binghong Wu, Zhenyu Huang, Jiacheng Shi, Shuo Huang, Tinghao Yu, Feng Zhang2026-08-04
💻 computer science

DiffuseAgent-MI: Distributionally-Grounded,Tool-Integrated Self-Evolving Agents for Faithful Visual Reasoning

يُعدّ DiffuseAgent-MI عميلًا متكاملًا مع الأدوات وذاتي التطور، يضمن الاستدلال البصري الأمين عبر الجمع بين نموذج طاقة أدنى في تباين كولباك-ليبلر (KL-minimal energy model) للتأسيس الإدراكي التوزيعي، وآلية إصلاح مدفوعة بالتحقق لضمان الاتساق على مستوى المسار، مما يحسن بشكل كبير من كل من الدقة والقابلية للتفسير عبر مختلف المعايير متعددة الوسائط.

An Lanji, Dawei Liu, Jin Li, Haoran Xu, Mei Chen, Yu Tian2026-08-04
💻 computer science

Robust Watermarks Meet Backdoored Models: Evading Diffusion Semantic Watermarks via Stealthy Backdoor

تقدم هذه الورقة البحثية GhostVAE، وهو هجوم باب خلفي خفي يستهدف اختراق المشفر الخاص بالمشفرات التلقائية التباينية (Variational Autoencoders) للتحايل بشكل موثوق على العلامات المائية الدلالية في نماذج الانتشار الكامنة (Latent Diffusion Models) مع الحفاظ على دقة كشف عالية للصور السليمة، مما يكشف عن ثغرات أمنية حرجة في أمن الأنظمة المتكاملة لأنظمة العلامات المائية الحالية.

Jinyuan Liu, Tianshuo Cong, Pei Li, Tianrui Wang, Xinlei He, Anyu Wang, Xiaoyun Wang2026-08-04
💻 computer science

DrawAI: Agentic Benchmark and Workflow for Making Raster Images Editable

تقدم هذه الورقة DrawAI، وهو إطار عمل شامل يتكون من معيار DrawAI-Bench وسير عمل الوكيل DrawAI-Flow، والمصمم لإعادة بناء الصور النقطية (raster) إلى رسومات مهيكلة وقابلة للتعديل من خلال الموازنة بفعالية بين الدقة البصرية والقابلية للتعديل الدلالي.

Pu Cao, Qingye Kong, Xuedan Yin, Xuekun Zhao, Rupeng Yan, Qing Song, Yao Zhang, Lu Yang2026-08-04
💻 computer science

Test-Time Curriculum for Open-Set AIGC Detection

تقترح هذه الورقة "منهج التعلم التدريجي عند وقت الاختبار" (TTC)، وهو إطار عمل غير مرتبط بنموذج محدد يعزز الكشف عن المحتوى المولد بواسطة الذكاء الاصطناعي (AIGC) في المجموعات المفتوحة تحت تحولات المولدات غير المرئية، وذلك عبر تحسين الملصقات الوهمية تكيفياً من خلال عملية تدريب ذاتي قائمة على منهج تدريجي وتجميع الأدلة عبر المقاييس المختلفة، وقد تم التحقق من صحة ذلك باستخدام معيار شامل جديد يسمى AIGCGuard.

Yiqian Zhang, Zheyuan Gu, Xiangzhao Hao, Zefeng Zhang, Jingjia Mao, Jiahao Hu, Jiaxu Miao, Jun Yu, Zhenyu Zhang, Shuohua (…)2026-08-04
💻 computer science

Representation Transfer of Foundation Models for Ultra-Widefield Retinal Imaging

تستقصي هذه الورقة البحثية كيف تؤثر استراتيجيات ما قبل التدريب المختلفة للنماذج التأسيسية على قابليتها للنقل إلى مهام تصوير الشبكية واسعة المجال ضمن إطار تعلم المجموعات المتعددة، حيث وجدت أن أهداف الإشراف والتقطير الذاتي تتفوق عمومًا على الترميز التلقائي المقنع، مع تحقيق نموذج DINOv3 واسع النطاق لأفضل أداء حالي في تصنيف اعتلال الشبكية السكري.

Mingya Alexa Gong, Da Ma, Lovre Antonio Budimir, Ivana Matovinovic, Sven Loncaric, Myeong Jin Ju, Yukun Zhou, Siegfried (…)2026-08-04
💻 computer science

Diagnosing Under-Development of Irreversible Processes in Video Generation

تكشف هذه الورقة أن نماذج تحويل النص إلى فيديو الحالية تعاني من "عدم نضج"، حيث تفشل في دفع السمات الفيزيائية غير القابلة للانعكاس نحو الأمام بمرور الوقت بدلاً من عكسها، وتقترح بروتوكولاً قوياً يتكون من جزأين لقياس هذا النقص مع إثبات أن فرض الرتابة في التمثيلات الكامنة يمنع التوجيه القابل للتلاعب في القراءة.

Jian Xu, Yanning Wu, Delu Zeng, John Paisley, Qibin Zhao2026-08-04