💻 computer science

Where Detectors Fail: Probing Generative Space for Generalizable AI-Generated Image Detection

تقدم الورقة البحثية إطار عمل PROBE، الذي يعزز قدرة كواشف الصور المولدة بالذكاء الاصطناعي على التعميم من خلال الاستكشاف النشط للمناطق الصعبة في الفضاء التوليدي لإنتاج عينات صعبة تهدف إلى تحسين متانة الكاشف ضد المولدات غير المرئية.

Zijie Cao, Weijie Tu, Yao Xiao, Weijian Deng, Liang Lin, Pengxu Wei2026-05-26
💻 computer science

Snapshot Polarimetric Display Inverse Rendering

تقدم هذه الورقة إطار عمل لإعادة التصوير العكسي الاستقطابي بلقطة واحدة، يستخدم جهاز عرض LCD مستقطب وكاميرا استقطاب لتقدير خصائص السطح لكل بكسل (الناظم، والوضاءة، والخشونة، والمعدنية) في لقطة واحدة، متجاوزةً ندرة البيانات من خلال متشعب توليدي ومثبتةً دقة فائقة في إعدادات سطح المكتب الواقعية.

Seokjun Choi, Yunseong Moon, Kaizhang Kang, Hoon-Gyu Chung, Jin-Nyeong Kim, Giljoo Nam, Seung-Hwan Baek2026-05-26
💻 computer science

X-Edit: Exact, Explicit, and Explainable Null-Space Editing for Medical Vision Transformers

يُعد X-Edit إطار عمل لتحرير الفراغ الصفري (null-space) ذو صيغة مغلقة ومبني على أسس نظرية لنماذج المحولات الرؤيوية (Vision Transformers) الطبية، حيث يقوم بتحديد التنبؤات الخاطئة بدقة وتطبيق تحديثات بارامترية متعامدة لتصحيح أخطاء محددة دون التسبب في نسيان كارثي للقدرات التشخيصية التي تم تعلمها مسبقاً.

Yuanye Liu, Siyuan Zhou, Ke Zhang, Lei Li, Wei Chen, Xiahai Zhuang2026-05-26
🤖 AI

Your Embedding Model is SMARTer Than You Think

تقدم الورقة البحثية إطار عمل SMART، الذي يطلق قدرات المتجهات المتعددة الكامنة في نماذج التضمين القياسية أحادية المتجه من خلال الاستفادة من الحالات الخفية المجمدة أثناء الاستدلال، مما يحسن بشكل كبير أداء الاسترجاع متعدد الوسائط دون الحاجة إلى إعادة تدريب مكثفة.

Jianrui Zhang, Hyun Jung Lee, Sukanta Ganguly, Tae-Eui Kam, Donghyun Kim, Yong Jae Lee2026-05-26
💻 computer science

Interpretability Transfer from Language to Vision via Sparse Autoencoders

تقدم هذه الورقة إطار عمل VISTA، الذي ينقل القابلية للتفسير من اللغة إلى الرؤية عبر محاذاة الرموز البصرية مع فضاء مشتت تلقائي (SAE) نصي موجود مسبقاً وموسوم في نماذج الرؤية واللغة، مما يتيح تحديد مواقع المفاهيم البصرية بدقة وتدخلات عابرة للنماذج متعددة الوسائط بفعالية دون الحاجة لتدريب مشتتات تلقائية (SAEs) مخصصة للرؤية.

Alexey Kravets, Da Li, Chuan Li, Da Chen, Vinay P. Namboodiri2026-05-26
💻 computer science

Tempered Self-Similarity Alignment for Physically Plausible Video Generation

تقدم هذه الورقة البحثية طريقة "محاذاة التشابه الذاتي الملطف" (TSA)، وهي طريقة تدريب مبتكرة تعزز المعقولية الفيزيائية للفيديوهات المولدة من خلال محاذاة توزيعات التشابه الذاتي المكاني-الزماني الخاصة بها مع توزيعات النماذج التأسيسية البصرية لالتقاط تفاعلات الأجسام وديناميكياتها في العالم الحقيقي بشكل أفضل.

Manjin Kim, Suha Kwak, Minsu Cho2026-05-26
💻 computer science

ConFi-GS Confidence-Guided High-Frequency Injection for 3D Gaussian Splatting Super-Resolution

تقترح هذه الورقة ConFi-GS، وهو إطار عمل لنمذجة التردد يعتمد على الموثوقية ويعزز دقة فائقة لتقنية Gaussian Splatting ثلاثية الأبعاد من خلال التمييز بين المناطق التي تحتاج إلى تفاصيل وتلك التي تحتوي على محتوى عالي التردد موثوق، مما يوجه مخطط تحسين موحد لحقن أنسجة متسقة وعالية الدقة مع كبح العيوب غير المتسقة عبر الرؤى.

Jiaxiang Li, Zongtan Zhou, Zhen Tan, Yadong Liu, Dewen Hu2026-05-26
🤖 AI

Cross-Domain Generalization Limits of Vision Foundation Models in Facial Deepfake Detection

تقيم هذه الورقة بشكل منهجي حدود التعميم عبر النطاقات لنماذج الرؤية التأسيسية في كشف التزييف العميق للوجوه، كاشفةً أنه بينما تتفوق هذه النماذج في تحديد التزييف الكامل للوجه، فإنها تعاني مع تقنيات التعديل الموضعي بسبب المقايضات المتأصلة بين نماذج التدريب المسبق وهياكل تقييم المسبار الخطي.

Ibrahim Delibasoglu2026-05-26✓ Author reviewed
💬 NLP

Universal Boosts, Specific Suppressors: Sparse Autoencoder Steering of Medical Vision-Language Models

تقدم هذه الورقة طريقة تعتمد على الاستدلال فقط باستخدام التوجيه المتبقي القائم على المشفر التلقائي المتناثر لتقليل الهلوسة بشكل كبير وتحسين جودة التقارير في النماذج اللغوية الرؤيوية الطبية من خلال تطبيق اتجاهات تعزيز عالمية واتجاهات كبح خاصة بالنموذج، مما يثبت الفعالية عبر بنيات ومجموعات بيانات متعددة دون الحاجة إلى إعادة التدريب.

Farhad Nooralahzadeh, Benjamin Gundersen, Nicolas Deperrois, Hidetoshi Matsuom, Mizuho Nishio, Thomas Frauenfelder, Ahme (…)2026-05-26
💻 computer science

ClueAegis: Heuristic-to-Reasoning Cognitive-skill Learning for Unified Evidence-based Synthetic Image Detection

تقترح هذه الورقة ClueAegis، وهو إطار عمل وكيل جديد ثنائي المراحل يعيد صياغة الكشف عن الصور الاصطناعية كعملية معرفية مهيكلة وقائمة على الأدلة من خلال دمج استخراج القرائن الاستدلالي مع الاستدلال المشروط بالمهارة لتحقيق أداء يضاهي أحدث ما توصل إليه العلم، وتعزيز القدرة على التعميم، والتحليل الجنائي القابل للتفسير.

Huangsen Cao, Hongkang Chu, Yuxi Li, Ying Zhang, Chen Li, Jing Lyu, Yongwei Wang, Yu Zhao, Fei Wu2026-05-26