💻 computer science

ChartAct: A Benchmark for Dynamic Chart Understanding

تقدم هذه الورقة البحثية ChartAct، وهو معيار مرجعي تفاعلي جديد يتكون من 1,440 عينة عالية الجودة عبر 7 أنواع من الرسوم البيانية وبيئتين لتقييم الفهم الديناميكي للرسوم البيانية، مما يكشف أن النماذج متعددة الوسائط ووكلاء واجهة المستخدم الرسومية (GUI agents) لا تزال تواجه قيوداً كبيرة في التعامل مع عمليات الرسوم البيانية التفاعلية.

Muye Huang, Wu Lin, Lingling Zhang, Hang Yan, Zhiyuan Wang, Yumeng Fu, Zesheng Yang, Jun Liu2026-05-27
💻 computer science

NeR-SC: Adapting Neural Video Representation to Screen Content

تقترح الورقة البحثية NeR-SC، وهو إطار عمل لتمثيل الفيديو العصبي مصمم خصيصاً لمحتوى الشاشة، يقدم لوحة ألوان قابلة للتعلم، ووحدة دمج كثيفة متعددة البوابات، واستراتيجية تخطي إطارات على مستوى التضمين للتفوق بشكل كبير على الطرق العصبية الحالية والترميزات التقليدية مثل H.264/H.265 من حيث الجودة وكفاءة فك التشفير.

Ruohan Shi, Jiaoyan Zhao, Haogang Feng2026-05-27
💻 computer science

SCKAN: Structural Consensus-based KAN Prototype Learning for Semi-Supervised Pancreas Segmentation

تقترح الورقة البحثية SCKAN، وهو إطار عمل جديد للتعلم شبه المُشرف يدمج شبكات كولموغوروف-أرنولد مع آليات الإجماع الهيكلي للتغلب على انحياز الإشراف وتحسين القدرة على التعميم في تقسيم البنكرياس في ظل ظروف التوسيم الشحيحة.

Yuqi Liu, Yufei Chen, Wei Fu, Xiaodong Yue, Shuo Li2026-05-27
🤖 machine learning

JLT: Clean-Latent Prediction in Latent Diffusion Transformers

يقدم هذا البحث نموذج JLT، وهو محول انتشار كامن (latent diffusion Transformer) يظهر أن التنبؤ بالكمون النظيف (clean-latent prediction) يتفوق على التنبؤ بالسرعة (velocity prediction) في الفضاءات الكامنة من خلال التعامل بشكل أفضل مع الاتجاهات ذات التباين المنخفض وتحقيق جودة توليد فائقة لصور ImageNet 256x256 (بمعامل FID قدره 2.50)، مما يشير إلى أن أهداف التنبؤ هي خيارات هندسية تعتمد على التمثيل وليست معاملات جبرية قابلة للتبادل.

Funing Fu, Tenghui Wang, Junyong Cen, Qichao Zhu, Guanyu Zhou2026-05-27
🤖 machine learning

PILOT: A Data-Free Continual Learning Approach for Real-Time Semantic Segmentation via Boundary Guidance

تقترح الورقة البحثية إطار عمل PILOT، وهو إطار تعلم مستمر خالٍ من البيانات للتجزئة الدلالية في الوقت الفعلي، والذي يخفف من النسيان الكارثي في نموذج PIDNet عبر توظيف فرع اشتقاق موازٍ لالتقاط معلومات الحدود عالية التردد للفئات الجديدة مع تجميد المعلمات الأصلية، محققاً بذلك أداءً فائقاً مع حد أدنى من زمن تأخير الاستدلال.

Yujing Zhou, Prashant Shekhar, Thomas Yang, Yongxin Liu2026-05-27
💻 computer science

Image Thresholding: Understanding Bias of Evaluation Metrics towards Specific Evaluation Functions

تكشف هذه الورقة عن انحياز متأصل في تقييم تجزئة الصور، حيث تُظهر أن دالة هدف تباين الفئات بين الفئات لـ "أوتسو" ترتبط باستمرار بشكل أقوى مع مقاييس الجودة القياسية مثل SSIM وPSNR مقارنة بإنتروبيا "كابور"، مما يتحدى فرضية الحياد المتركي.

Eslam Hegazy, Mohamed Gabr2026-05-27
💻 computer science

Chaos-SSL: An Attention-Based Self-Supervised Learning Framework with Chaotic Transformation for Medical Image Classification

تقدم الورقة البحثية Chaos-SSL، وهو إطار عمل جديد للتعلم الذاتي الإشراف المكون من مرحلتين والذي يستفيد من الخرائط الفوضوية أحادية البعد لتعزيز البيانات المعقدة وآلية دمج قائمة على الانتباه لتحقيق أداء رائد في تصنيف الصور الطبية لآفات الجلد واعتلال الشبكية السكري على مجموعات البيانات.

Joao Batista Florindo2026-05-27
💻 computer science

Model discovery for dynamical systems with complex-valued product units

تقدم هذه الورقة طريقة لاكتشاف النماذج القائمة على البيانات باستخدام شبكات الوحدات ذات القيم المركبة التي تتعلم المعادلات الحاكمة مباشرة من البيانات دون مكتبات دوال محددة مسبقاً، حيث نجحت في استعادة الديناميكيات الدقيقة للأنظمة الفوضوية وتوليد تنبؤات مستقرة لإشارات مشية الإنسان في العالم الحقيقي.

Martin Brückmann, Babette Dellen, Uwe Jaekel2026-05-27
🤖 AI

Generative Animations: A Multi-Model Pipeline for Prompt-Driven Motion Synthesis

تقدم هذه الورقة "الرسوم المتحركة التوليدية" (Generative Animations)، وهي مسار معالجة متعدد النماذج يستفيد من النماذج اللغوية الكبيرة ونموذج (Segment Anything Model) لتحويل المطالبات باللغة الطبيعية تلقائياً إلى مسارات حركة مدركة هندسياً وجاهزة للإنتاج، مما يلغي الحاجة إلى تكوين الرسوم المتحركة يدوياً.

Mannat Khurana, Sanyam Jain, Rishav Agarwal2026-05-27