💻 computer science

Learnability-Guided Diffusion for Dataset Distillation

تقترح هذه الورقة نموذج "الانتشار الموجه بالقابلية للتعلم" (LGD)، وهو إطار عمل جديد لتقطير مجموعات البيانات يقوم بتوليد بيانات اصطناعية بشكل تدريجي بناءً على درجات القابلية للتعلم لتقليل تكرار إشارات التدريب وتحقيق أداء رائد في الاختبارات المعيارية واسعة النطاق.

Jeffrey A. Chan-Santiago, Mubarak Shah2026-04-02
💻 computer science

TF-SSD: A Strong Pipeline via Synergic Mask Filter for Training-free Co-salient Object Detection

تقترح هذه الورقة البحثية TF-SSD، وهي طريقة جديدة للكشف عن الأجسام البارزة المشتركة دون الحاجة إلى تدريب، تعمل على دمج نموذجي SAM وDINO لتوليد وتكرير واختيار الأقنعة البارزة من خلال التصفية داخل الصورة واختيار النماذج الأولية بين الصور، مما يحقق قدرة تعميم وأداءً متفوقين مقارنة بالأساليب الحالية.

Zhijin He, Shuo Jin, Siyue Yu, Shuwei Wu, Bingfeng Zhang, Li Yu, Jimin Xiao2026-04-02
🤖 machine learning

Multi-Camera View Scaling for Data-Efficient Robot Imitation Learning

تقترح هذه الورقة إطار عمل للتعلم بالتقليد يتسم بكفاءة البيانات، حيث يعزز قدرة الروبوت على التعميم من خلال توسيع نطاق زوايا الكاميرا لتوليد عروض توضيحية زائفة متنوعة من مسارات خبير واحدة، مما يؤدي إلى تحسين الثبات تجاه تغير زوايا الرؤية وتمكين سياسات الرؤية الواحدة من الاستفادة من بيانات الكاميرات المتعددة أثناء النشر دون الحاجة إلى عروض توضيحية بشرية إضافية.

Yichen Xie, Yixiao Wang, Shuqi Zhao, Cheng-En Wu, Masayoshi Tomizuka, Jianwen Xie, Hao-Shu Fang2026-04-02
💻 computer science

FecalFed: Privacy-Preserving Poultry Disease Detection via Federated Learning

تقدم هذه الورقة FecalFed، وهو إطار عمل للتعلم الاتحادي يحافظ على الخصوصية ويستخدم مجموعة بيانات براز دواجن منقحة بدقة وتحسيناً تكيفياً لتحقيق كشف عالي الدقة عن أمراض الطيور في ظل ظروف غير متطابقة (non-IID)، مع إلغاء الحاجة إلى مركزية بيانات المزارع الحساسة.

Tien-Yu Chi2026-04-02
💻 computer science

TALENT: Target-aware Efficient Tuning for Referring Image Segmentation

تقدم هذه الورقة TALENT، وهو إطار عمل مبتكر لتجزئة الصور المرجعية يعالج مشكلة "التنشيط غير المستهدف" في الضبط الفعال للمعلمات من خلال توظيف مجمع تكلفة مُصحح وآلية تعلم مدركة للهدف لمعايرة الميزات البصرية بفعالية نحو الأهداف المحددة نصياً، محققاً أداءً هو الأفضل في فئته.

Shuo Jin, Siyue Yu, Bingfeng Zhang, Chao Yao, Meiqin Liu, Jimin Xiao2026-04-02
💻 computer science

When AI and Experts Agree on Error: Intrinsic Ambiguity in Dermatoscopic Images

تكشف هذه الدراسة أن بعض الصور الجلدية (Dermatoscopic) تمتلك غموضاً بصرياً جوهرياً يتسبب في إخفاقات تشخيصية منهجية لدى كل من نماذج الذكاء الاصطناعي والخبراء البشريين، كما يتضح من الانهيار الكبير في معدلات الاتفاق وموثوقية التوافق بين المقيمين عند مقارنتها بحالات الضبط.

Loris Cino, Pier Luigi Mazzeo, Alessandro Martella, Giulia Radi, Renato Rossi, Cosimo Distante2026-04-02
💻 computer science

MoonAnything: A Vision Benchmark with Large-Scale Lunar Supervised Data

تقدم هذه الورقة MoonAnything، وهو معيار موحد واسع النطاق يضم أكثر من 130 ألف عينة من التضاريس القمرية الحقيقية مع رندر قائم على الفيزياء لتوفير إشراف هندسي وضوئي شامل للإدراك القوي تحت ظروف إضاءة متنوعة.

Clémentine Grethen, Yuang Shi, Simone Gasparini, Géraldine Morin2026-04-02
💻 computer science

TP-Seg: Task-Prototype Framework for Unified Medical Lesion Segmentation

تقترح الورقة البحثية TP-Seg، وهو إطار عمل قائم على النماذج الأولية للمهام (task-prototype framework) يستخدم مُكيِّفًا مشروطًا بالمهمة وفك تشفيرًا موجهًا بالنماذج الأولية لموازنة التمثيلات المشتركة والخاصة بالمهمة بفعالية، محققًا أداءً فائقًا عبر مهام متنوعة لتجزئة الآفات الطبية دون الاعتماد على آليات مساعدة معقدة.

Jiawei Xu, Qiangqiang Zhou, Dandan Zhu, Yong Chen, Yugen Yi, Xiaoqi Zhao2026-04-02
💻 computer science

TTA-Vid: Generalized Test-Time Adaptation for Video Reasoning

يقدم TTA-Vid إطار عمل للتكيف في وقت الاختبار لاستنتاج الفيديو، والذي يستفيد من التعلم التعزيزي مع مكافآت قائمة على التردد ومدركة للدفعة واختيار إطارات تكيفي لتمكين النماذج سابقة التدريب من التعميم بفعالية عبر مجموعات البيانات دون الحاجة إلى تعليقات توضيحية للحقيقة الأرضية أو إعادة تدريب مكثفة.

Soumya Shamarao Jahagirdar, Edson Araujo, Anna Kukleva, M. Jehanzeb Mirza, Saurabhchand Bhati, Samuel Thomas, Brian King (…)2026-04-02
🤖 machine learning

A Benchmark of State-Space Models vs. Transformers and BiLSTM-based Models for Historical Newspaper OCR

تقدم هذه الورقة أول بنية للتعرف الضوئي على الحروف (OCR) تعتمد على نماذج فضاء الحالة (Mamba) للصحف التاريخية، مبرهنةً على تحقيقها دقة تنافسية مع تحسن ملحوظ في كفاءة الحوسبة وتوسع الذاكرة مقارنة بالنماذج المرجعية القائمة على المحولات (Transformer) والشبكات العصبية المتكررة ثنائية الاتجاه (BiLSTM).

Merveilles Agbeti-messan, Thierry Paquet, Clément Chatelain, Pierrick Tranouez, Stéphane Nicolas2026-04-02