💻 computer science

CheXmask-U: Quantifying uncertainty in landmark-based anatomical segmentation for X-ray images

تقدم هذه الورقة البحثية CheXmask-U، وهو إطار عمل يستفيد من البنى العصبية الهجينة لتقدير عدم اليقين الكامن والتنبؤي في تقسيم معالم الأشعة السينية للصدر، والذي تم التحقق من صحته من خلال تجارب الاضطراب وإصداره كمجموعة بيانات واسعة النطاق لتعزيز متانة وسلامة نماذج التقسيم التشريحي.

Matias Cosarinsky, Nicolas Gaggion, Rodrigo Echeveste, Enzo Ferrante2026-02-24
💻 computer science

Foundation Model Priors Enhance Object Focus in Feature Space for Source-Free Object Detection

تقترح الورقة البحثية إطار عمل FALCON-SFOD، وهو إطار عمل للكشف عن الأشياء بدون الوصول إلى المصدر، يستفيد من مسبقات النماذج التأسيسية عبر تقنية SPAR لفرض تمثيلات سمات مركزة على الأشياء، ويستخدم تقنية IRPL لتوليد تسميات مستعارة قوية، مما يتغلب على مشكلات انزياح النطاق وفوضى الخلفية المتأصلة في مناهج "المعلم المتوسط" الحالية.

Sairam VCR, Rishabh Lalla, Aveen Dayal, Tejal Kulkarni, Anuj Lalla, Vineeth N Balasubramanian, Muhammad Haris Khan2026-02-24
💻 computer science

Object-WIPER : Training-Free Object and Associated Effect Removal in Videos

تقدم الورقة البحثية Object-WIPER، وهو إطار عمل لا يتطلب تدريباً يستفيد من نماذج المحولات لانتشار النصوص إلى الفيديو (text-to-video diffusion transformers) المُدربة مسبقاً لإزالة الأجسام الديناميكية والتأثيرات البصرية المرتبطة بها من مقاطع الفيديو مع ضمان ملء الفراغات بشكل متسق دلالياً ومتماسك زمنياً.

Saksham Singh Kushwaha, Sayan Nag, Yapeng Tian, Kuldeep Kulkarni2026-02-24
💻 computer science

LookBench: A Live and Holistic Open Benchmark for Fashion Image Retrieval

تقدم هذه الورقة البحثية LookBench، وهو معيار مرجعي مفتوح وحي وشامل لاسترجاع صور الأزياء، يتميز بصور من الواقع ومن إنتاج الذكاء الاصطناعي مختومة زمنياً، وتصنيف سمات دقيق، وتحديثات دورية لتوفير تقييم مستدام وواعٍ بالتلوث لنماذج الاسترجاع في بيئات التجارة الإلكترونية الحقيقية.

Gensmo. ai, Chao Gao, Siqiao Xue, Yimin Peng, Jiwen Fu, Tingyi Gu, Shanshan Li, Fan Zhou2026-02-24
💻 computer science

RepSFNet : A Single Fusion Network with Structural Reparameterization for Crowd Counting

تُعد RepSFNet بنية خفيفة الوزن وآنية لعد الحشود، تستخدم عمود فقري من نوع RepLK-ViT مع إعادة تمثيل هيكلية ووحدة دمج متخصصة لتحقيق دقة عالية وزمن استجابة منخفض عبر التخلص من آليات الانتباه المعقدة مع معالجة تباينات الحجم والانسدادات بشكل فعال.

Mas Nurul Achmadiah, Chi-Chia Sun, Wen-Kai Kuo, Jun-Wei Hsieh2026-02-24
⚡ electrical engineering

Zero-shot Multi-Contrast Brain MRI Registration by Intensity Randomizing T1-weighted MRI (LUMIR25)

تقدم هذه الورقة البحثية LUMIR25، وهي طريقة لتسجيل صور الرنين المغناطيسي للدماغ متعددة التباين بنمط "التعلم الصفري" (zero-shot)، والتي حققت المركز الأول في مسابقة Learn2Reg 2025 من خلال الجمع بين الانحيازات الاستقرائية الخاصة بالتسجيل وبين العشوائية في شدة الإضاءة والتحسين الخفيف الخاص بالنماذج (instance-specific optimization) للتعميم من بيانات التدريب ذات الوزن الأول (T1-weighted) إلى تباينات متنوعة دون الحاجة إلى توليد صور صريح.

Hengjie Liu, Yimeng Dou, Di Xu, Xinyi Fu, Dan Ruan, Ke Sheng2026-02-24
💻 computer science

Agent Banana: High-Fidelity Image Editing with Agentic Thinking and Tooling

تقدم الورقة البحثية "Agent Banana"، وهو إطار عمل وكيل هرمي يتميز بخاصيتي "طي السياق" (Context Folding) و"تفكيك طبقات الصور" (Image Layer Decomposition) لتمكين تحرير صور متعدد الدورات وعالي الدقة بدقة أصلية تبلغ 4K، وهو ما تم التحقق منه عبر معيار "HDD-Bench" الجديد.

Ruijie Ye, Jiayi Zhang, Zhuoxin Liu, Zihao Zhu, Siyuan Yang, Li Li, Tianfu Fu, Franck Dernoncourt, Yue Zhao, Jiacheng Zh (…)2026-02-24
💻 computer science

Energy-Efficient Fast Object Detection on Edge Devices for IoT Systems

تقترح هذه الورقة إطار عمل لكشف الأشياء يتميز بكفاءة الطاقة وخفة الوزن لأجهزة حافة إنترنت الأشياء، والذي يستفيد من طريقة فرق الإطارات مع MobileNet لتحقيق دقة أعلى بكثير، وزمن انتقال أقل، وكفاءة أفضل في استهلاك الطاقة مقارنة بالطرق التقليدية من طرف إلى طرف، لا سيما للكشف عن الأجسام سريعة الحركة مثل القطارات والطائرات.

Mas Nurul Achmadiah, Afaroj Ahamad, Chi-Chia Sun, Wen-Kai Kuo2026-02-24
💻 computer science

Tele-Omni: a Unified Multimodal Framework for Video Generation and Editing

تُعد Tele-Omni إطار عمل موحداً متعدد الوسائط يستفيد من النماذج اللغوية الكبيرة سابقة التدريب لتحليل تعليمات متنوعة للنصوص والصور والفيديو من أجل نموذج واحد قائم على الانتشار، مما يتيح توليد وتحرير الفيديو بمرونة وجودة عالية عبر مهام متعددة ضمن نظام متماسك.

Jialun Liu, Tian Li, Xiao Cao, Yukuo Ma, Gonghu Shang, Haibin Huang, Chi Zhang, Xiangzhen Chang, Zhiyong Huang, Jiakui H (…)2026-02-24
💻 computer science

SAGE: Scalable Agentic 3D Scene Generation for Embodied AI

إن SAGE هو إطار عمل وكيل (agentic framework) يقوم تلقائياً بتوليد بيئات ثلاثية الأبعاد قابلة للتوسع، وواقعية، وصالحة فيزيائياً، ومصممة خصيصاً لمهام تجسدية محددة من خلال الاستنتاج التكراري والتقييم متعدد النقاد، مما يتيح تدريب السياسات التي تعمم بفعالية على سيناريوهات غير مرئية.

Hongchi Xia, Xuan Li, Zhaoshuo Li, Qianli Ma, Jiashu Xu, Ming-Yu Liu, Yin Cui, Tsung-Yi Lin, Wei-Chiu Ma, Shenlong Wang (…)2026-02-24