🔢 mathematics

A Robust Low-Rank Prior Model for Structured Cartoon-Texture Image Decomposition with Heavy-Tailed Noise

تقترح هذه الورقة نموذجاً مسبقاً متيناً منخفض الرتبة لتفكيك صور الأنسجة الكرتونية تحت تأثير الضجيج ذي الذيول الثقيلة، والذي يستخدم دالة خسارة "هوبر" لسلامة البيانات ويوظف خوارزميات تقسيم العمليات لتحقيق أداء فائق في مهام ترميم الصور.

Weihao Tang, Hongjin He2026-03-31
🤖 AI

ContraMap: Contrastive Uncertainty Mapping for Robot Environment Representation

تُعد ContraMap طريقة خرائط تباينية في الوقت الفعلي وغير بايزية، تعمل على تعزيز الخرائط التمييزية القائمة على النواة بفئة عدم يقين صريحة مُدربة على ضوضاء اصطناعية للتنبؤ المشترك ببنية البيئة وعدم اليقين المكاني، مما يوفر كفاءة وتماسكاً متفوقين مقارنة بالنماذج المرجعية البايزية.

Chi Cuong Le, Weiming Zhi2026-03-31
💻 computer science

V-CAST: Video Curvature-Aware Spatio-Temporal Pruning for Efficient Video Large Language Models

تُعد V-CAST طريقة تقليم (pruning) جاهزة للاستخدام ولا تتطلب تدريباً لنماذج الفيديو اللغوية الكبيرة (VideoLLMs)، حيث تعالج فقدان المعلومات المكانية والزمانية في الاستدلال طويل السياق عبر نمذجة ضغط الرموز (token compression) كمسألة تقريب للمسار، مستخدمةً تخصيصاً زمنياً موجهاً بالانحناء واختياراً مكانياً مزدوج المرتكزات لتقليل الذاكرة وزمن الاستجابة بشكل كبير مع الحفاظ على 98.6% من الأداء الأصلي.

Xinying Lin, Xuyang Liu, Yiyu Wang, Teng Ma, Wenqi Ren2026-03-31
💻 computer science

A Benchmarking Methodology to Assess Open-Source Video Large Language Models in Automatic Captioning of News Videos

تقدم هذه الورقة منهجية قياس مرجعي شاملة تتميز بمقاييس دقة مبتكرة (TFS وEFS) لتقييم ثمانية من نماذج اللغات الكبيرة للفيديو مفتوحة المصدر في مجال وصف مقاطع الفيديو الإخبارية، مما يكشف أن Gemma 3 يتفوق على النماذج الأخرى مع تسليط الضوء على أوجه القصور في المقاييس المعجمية والدلالية القياسية في هذا المجال.

David Miranda Paredes, Jose M. Saavedra, Marcelo Pizarro2026-03-31
🤖 machine learning

Test-Time Instance-Specific Parameter Composition: A New Paradigm for Adaptive Generative Modeling

تقدم الورقة البحثية "Composer"، وهو نموذج جديد للنمذجة التوليدية التكيفية يقوم بتكوين معلمات محددة للمدخلات ديناميكيًا وقت الاختبار لحقن تكيفات مدركة للسياق في النماذج سابقة التدريب، مما يحسن جودة المخرجات بشكل كبير ويمكّن من التوسع بكفاءة دون الحاجة إلى الضبط الدقيق أو إعادة التدريب.

Minh-Tuan Tran, Xuan-May Le, Quan Hung Tran, Mehrtash Harandi, Dinh Phung, Trung Le2026-03-31
💻 computer science

Can Unsupervised Segmentation Reduce Annotation Costs for Video Semantic Segmentation?

تُثبت هذه الورقة أن الاستفادة من النماذج التأسيسية مثل SAM وSAM 2 لأتمتة توليد الأقنعة من الإطارات غير المشروحة والتعليقات التوضيحية التقريبية يمكن أن تقلل تكاليف التوسيم اليدوي بمقدار الثلث مع الحفاظ على أداء مماثل لتجزئة الفيديو الدلالية، حيث ثبت أن تنوع إطارات مجموعة البيانات أكثر أهمية من الحجم المجرد.

Samik Some, Vinay P. Namboodiri2026-03-31
🤖 AI

RAP: Retrieve, Adapt, and Prompt-Fit for Training-Free Few-Shot Medical Image Segmentation

تقترح الورقة البحثية إطار عمل RAP، وهو إطار عمل خالٍ من التدريب لتقسيم الصور الطبية في حالات التعلم بلقطات قليلة، والذي يستفيد من الاسترجاع المورفولوجي، والتكيف المدرك للحدود، وتوليد المطالبات الاستراتيجي لتعزيز نموذج Segment Anything Model 2 (SAM2) دون الحاجة إلى ضبط دقيق، محققاً أداءً هو الأفضل في فئته عبر معايير قياسية متعددة.

Zhihao Mao, Bangpu Chen2026-03-31
🔭 astrophysics

Segmenting Superbubbles in a Simulated Multiphase Interstellar Medium using Computer Vision

تقدم هذه الورقة منهجية جديدة في الرؤية الحاسوبية تستخدم نماذج محولات ثلاثية الأبعاد متقدمة لتحقيق تجزئة وتتبع ثلاثي الأبعاد دقيقين للفقاعات الفائقة في محاكاة الديناميكا المائية المغناطيسية، مما يكشف عن رؤى تفصيلية حول تطورها الهيكلي، وأنماط نموها، وتفاعلاتها مع الوسط النجمي المحيط بها.

Jing-Wen Chen, Alex S. Hill, Anna Ordog, Rebecca A. Booth, Mohamed S. Shehata2026-03-31
🤖 AI

AI-Powered Facial Mask Removal Is Not Suitable For Biometric Identification

تقدم هذه الورقة تحليلاً واسع النطاق يثبت أن إزالة أقنعة الوجه المدعومة بالذكاء الاصطناعي، والتي تُستخدم غالباً في التحقيقات القائمة على المساهمات الجماعية، تفشل في إنتاج مطابقات بيومترية موثوقة وتفرض مخاطر جسيمة تتمثل في الخطأ في تحديد الهوية.

Emily A Cooper, Hany Farid2026-03-31
💻 computer science

E-TIDE: Fast, Structure-Preserving Motion Forecasting from Event Sequences

تقدم الورقة البحثية E-TIDE، وهي بنية طرفية إلى طرفية خفيفة الوزن وفعالة للتنبؤ بموترات الأحداث المستقبلية تستخدم وحدة TIDE مبتكرة لتحقيق أداء تنافسي في التنبؤ بالحركة دون الحاجة إلى تدريب مسبق واسع النطاق، مما يجعلها مثالية للتطبيقات التي تعمل في الوقت الفعلي والمقيدة بالموارد.

Biswadeep Sen, Benoit R. Cottereau, Nicolas Cuperlier, Terence Sim2026-03-31