🤖 AI

Med-CAM: Minimal Evidence for Explaining Medical Decision Making

تقدم الورقة البحثية Med-CAM، وهو إطار عمل مبتكر يولد تفسيرات قائمة على الأدلة تتسم بالحد الأدنى من الحجم والحدة والأمانة لقرارات الذكاء الاصطناعي الطبي عبر تدريب شبكة تجزئة لتسليط الضوء على السمات التشخيصية الحرجة، مما يتغلب بذلك على القيود الضبابية للأساليب الحالية مثل Grad-CAM لتعزيز ثقة الأطباء في التطبيقات الطبية عالية المخاطر.

Pirzada Suhail, Aditya Anand, Amit Sethi2026-04-16
💻 computer science

Granularity-Aware Transfer for Tree Instance Segmentation in Synthetic and Real Forests

تقدم هذه الورقة MGTD، وهي مجموعة بيانات متعددة الحبيبات وبروتوكولاً مكوناً من أربع مراحل يتميز بالتقطير الواعي بالحبيبات لنقل الأوليات الهيكلية بفعالية من التوصيفات الشجرية الاصطناعية دقيقة الحبيبات إلى البيانات الواقعية ذات الملصقات الخشنة، مما يحسن بشكل كبير أداء تقسيم المثيل للأشجار الصغيرة والبعيدة.

Pankaj Deoli, Atef Tej, Anmol Ashri, Anandatirtha JS, Karsten Berns2026-04-16
💻 computer science

ReConText3D: Replay-based Continual Text-to-3D Generation

يقدم ReConText3D أول إطار عمل ومعيار للإنشاء المستمر للنصوص إلى نماذج ثلاثية الأبعاد، وذلك باستخدام استراتيجية إعادة تشغيل k-Center لتمثيل النصوص (text-embedding k-Center replay) لتمكين التعلم التدريجي لفئات جديدة ثلاثية الأبعاد مع منع النسيان الكارثي للأصول التي تم تعلمها مسبقًا بشكل فعال.

Muhammad Ahmed Ullah Khan, Muhammad Haris Bin Amir, Didier Stricker, Muhammad Zeshan Afzal2026-04-16
💻 computer science

ClipGStream: Clip-Stream Gaussian Splatting for Any Length and Any Motion Multi-View Dynamic Scene Reconstruction

يقدم ClipGrest إطار عمل إعادة بناء هجين يقسم المتواليات الديناميكية متعددة المشاهد الطويلة إلى مقاطع قصعة ذات مجالات مكانية-زمانية مستقلة ومرتكزات موروثة، محققاً بذلك إعادة بناء ثلاثية الأبعاد رائدة وخالية من الوميض مع تماسك زمني عالٍ وتقليل في عبء الذاكرة.

Jie Liang, Jiahao Wu, Chao Wang, Jiayu Yang, Xiaoyun Zheng, Kaiqiang Xiong, Zhanke Wang, Jinbo Yan, Feng Gao, Ronggang W (…)2026-04-16
💬 NLP

Who Gets Flagged? The Pluralistic Evaluation Gap in AI Content Watermarking

تجادل هذه الورقة بأن أنظمة العلامات المائية لمحتوى الذكاء الاصطناعي الحالية تظهر "فجوة تقييم تعددية" من خلال فشلها في مراعاة كيفية تأثير تنوع المحتوى عبر اللغات والثقافات والديموغرافيا على أداء الكشف، مما يستلزم معايير قياس جديدة وعمليات تدقيق للعدالة قبل النشر لضمان الحوكمة المنصفة.

Alexander Nemecek, Osama Zafar, Yuqiao Xu, Wenbiao Li, Erman Ayday2026-04-16
💻 computer science

Failure Identification in Imitation Learning Via Statistical and Semantic Filtering

تقدم هذه الورقة FIDeL، وهو نموذج مستقل عن السياسة يجمع بين الكشف الإحصائي عن الشذوذ والترشيح الدلالي عبر نماذج الرؤية واللغة للتمييز بدقة بين الإخفاقات الحقيقية والانحرافات الحميدة في التعلم بالتقليد، والذي تم التحقق من صحته بواسطة مجموعة بيانات BotFails الجديدة والأداء المتفوق على النماذج المرجعية الحالية.

Quentin Rolland, Fabrice Mayran de Chamisso, Jean-Baptiste Mouret2026-04-16
💻 computer science

From Synchrony to Sequence: Exo-to-Ego Generation via Interpolation

تقترح هذه الورقة البحثية إطار عمل "Syn2Seq-Forcing"، وهو إطار مبتكر يعالج الانقطاعات المكانية والزمانية في توليد فيديوهات "إكسو-إيغو" (exo-ego) المتزامنة من خلال استكمال الفيديوهات المصدر والهدف إلى تسلسل مستمر، مما يمكّن النماذج القائمة على الانتشار من توليد مناظر منظور الشخص الأول متماسكة بفعالية من مدخلات منظور الشخص الثالث.

Mohammad Mahdi, Nedko Savov, Danda Pani Paudel, Luc Van Gool2026-04-16
💻 computer science

DRG-Font: Dynamic Reference-Guided Few-shot Font Generation via Contrastive Style-Content Disentanglement

تقدم هذه الورقة DRG-Font، وهو إطار عمل لتوليد الخطوط بعدد قليل من الأمثلة يستفيد من فك الارتباط التبايني بين الأسلوب والمحتوى، والاختيار الديناميكي للمراجع، وكتل الاندماج متعددة المقاييس للتغلب على القيود الحالية في التقاط الأساليب المعقدة والحفاظ على خصائص الرموز المحلية.

Rejoy Chakraborty, Prasun Roy, Saumik Bhattacharya, Umapada Pal2026-04-16
🤖 AI

Gaslight, Gatekeep, V1-V3: Early Visual Cortex Alignment Shields Vision-Language Models from Sycophantic Manipulation

تُظهر هذه الدراسة أن نماذج الرؤية واللغة ذات التمثيلات البصرية الأكثر توافقاً مع مناطق القشرة البصرية البشرية المبكرة (V1–V3) هي أكثر مقاومة بشكل ملحوظ للتلاعب التملقي، مما يشير إلى أن الترميز البصري منخفض المستوى الأمين يعمل كمرساة واقية ضد التجاوز اللغوي العدائي.

Arya Shah, Vaibhav Tripathi, Mayank Singh, Chaklam Silpasuwanchai2026-04-16
🤖 machine learning

Context Sensitivity Improves Human-Machine Visual Alignment

تقترح هذه الورقة طريقة لحساب التشابه الحساس للسياق باستخدام تضمينات الشبكات العصبية لنمذجة المعالجة البصرية الشبيهة بالبشر، محققةً تحسناً يصل إلى 15% في دقة مهمة "استخراج العنصر المختلف" مقارنة بالنماذج التقليدية غير الحساسة للسياق.

Frieda Born, Tom Neuhäuser, Lukas Muttenthaler, Brett D. Roads, Bernhard Spitzer, Andrew K. Lampinen, Matt Jones, Klaus- (…)2026-04-16