🤖 machine learning

Learning to Weight Parameters for Training Data Attribution

تقترح هذه الورقة طريقة مبتكرة تتعلم صراحةً أوزان أهمية المعلمات مباشرة من البيانات للتغلب على قيود تقنيات عزو البيانات القائمة على التدرج، مما يؤدي إلى تحسين دقة العزو وتمكين التحليل الدقيق عبر مهام متنوعة مثل تصنيف الصور، ونمذجة اللغة، والانتشار.

Shuangqi Li, Hieu Le, Jingyi Xu, Mathieu Salzmann2026-02-23
🤖 machine learning

View Invariant Learning for Vision-Language Navigation in Continuous Environments

تقدم هذه الورقة البحثية VIL، وهو إطار عمل للتدريب اللاحق يتسم بكونه ثابتاً تجاه زوايا الرؤية، ويستخدم التعلم التبايني ومنهجية تقطير المعرفة من المعلم إلى الطالب لتعزيز متانة وأداء الملاحة البصرية اللغوية في البيئات المستمرة ضد تباين زوايا الكاميرا، محققاً نتائج رائدة في كل من الاختبارات القياسية المحاكية وتقييمات الروبوتات الحقيقية.

Josh Qixuan Sun, Huaiyuan Weng, Xiaoying Xing, Chul Min Yeum, Mark Crowley2026-02-23
🤖 AI

ViGText: Deepfake Image Detection with Vision-Language Model Explanations and Graph Neural Networks

يُعد ViGText إطار عمل مبتكرًا للكشف عن التزييف العميق يدمج تفسيرات النماذج اللغوية الكبيرة للرؤية مع الشبكات العصبية الرسومية لتحقيق قدرة فائقة على التعميم والمتانة والدقة في تحديد التزييف العميق المتطور والمخصص.

Ahmad ALBarqawi, Mahmoud Nazzal, Issa Khalil, Abdallah Khreishah, NhatHai Phan2026-02-23
💻 computer science

Investigating Demographic Bias in Brain MRI Segmentation: A Comparative Study of Deep-Learning and Non-Deep-Learning Methods

تقيم هذه الدراسة التحيز الديموغرافي لطرق تقسيم صور الرنين المغناطيسي للدماغ، سواء القائمة على التعلم العميق أو الطرق التقليدية، عبر المجموعات الفرعية للعرق والجنس، كاشفةً أنه في حين تُظهر معظم النماذج تفاوتات في الأداء تعتمد على العرق عند تدريبها على بيانات متطابقة، فإن نموذج nn-U-Net القوي يحافظ على دقة ثابتة، كما أن الأحجام المستمدة من التقسيم تفشل إلى حد كبير في رصد التأثيرات الخاصة بالعرق الملحوظة في الحقيقة الأرضية اليدوية.

Ghazal Danaee, Marc Niethammer, Jarrett Rushmore, Sylvain Bouix2026-02-23
🧬 biology

Simple 3D Pose Features Support Human and Machine Social Scene Understanding

تُظهر هذه الدراسة أن الإدراك الاجتماعي البشري يعتمد على معلومات بسيطة وصريحة للوضعية ثلاثية الأبعاد، والتي تتفوق على معظم الشبكات العصبية العميقة في التنبؤ بالأحكام الاجتماعية ويمكنها تعزيز أداء الآلة بشكل كبير عند دمجها في هذه النماذج.

Wenshuo Qin, Leyla Isik2026-02-23
💻 computer science

UrbanGS: A Scalable and Efficient Architecture for Geometrically Accurate Large-Scene Reconstruction

يُعد UrbanGS إطار عمل لإعادة البناء القابل للتوسع للبيئات الحضرية واسعة النطاق، حيث يعزز الدقة الهندسية من خلال تنظيم التباعد الطبيعي المتسق مع العمق (Depth-Consistent D-Normal Regularization) ويحسن كفاءة الذاكرة عبر تقليم غاوس المكاني المتكيف (Spatially Adaptive Gaussian Pruning) ومخطط تقسيم موحد.

Changbai Li, Haodong Zhu, Hanlin Chen, Xiuping Liang, Tongfei Chen, Shuwei Shao, Linlin Yang, Huobin Tan, Baochang Zhang2026-02-23
🤖 AI

Temporal Pair Consistency for Variance-Reduced Flow Matching

تقدم هذه الورقة مبدأ اتساق الأزمنة المزدوجة (TPC)، وهو مبدأ خفيف الوزن وغير مرتبط ببنية معينة لتقليل التباين، يعمل على ربط تنبؤات السرعة عند الخطوات الزمنية المزدوجة لتحسين جودة وكفاءة العينات في النماذج التوليدية ذات الزمن المستمر مثل مطابقة التدفق دون تغيير أهدافها الأساسية أو أدوات الحل الخاصة بها.

Chika Maduabuchi, Jindong Wang2026-02-23
🤖 machine learning

Uncertainty-Aware Vision-Language Segmentation for Medical Imaging

تقدم هذه الورقة إطار عمل جديد لتقسيم الصور الطبية القائم على الرؤية واللغة والمدرك لعدم اليقين، والذي يستخدم كتلة انتباه فك تشفير النمط مع خلاط حالة مكانية خفيف الوزن لدمج عبر الأنماط بكفاءة، وفقدان عدم يقين طيفي-إنتروبي لتعزيز الموثوقية والأداء على مجموعات البيانات المتنوعة مع التفوق على الأساليب الحالية في كل من الدقة والكفاءة الحسابية.

Aryan Das, Tanishq Rachamalla, Koushik Biswas, Swalpa Kumar Roy, Vinay Kumar Verma2026-02-23
💻 computer science

Efficient Text-Guided Convolutional Adapter for the Diffusion Model

تقدم الورقة البحثية "Nexus Adapters"، وهي عائلة جديدة من الوحدات الالتفافية الفعالة والموجهة بالنص، والتي تعزز بشكل كبير توليد الصور المشروط المحافظ على البنية من خلال دمج آليات الانتباه المتقاطع لمعالجة المطالبات والمدخلات الهيكلية معاً، مع تقليل عدد المعلمات بشكل جذري مقارنة بالنماذج المرجعية الحالية.

Aryan Das, Koushik Biswas, Swalpa Kumar Roy, Badri Narayana Patro, Vinay Kumar Verma2026-02-23
💻 computer science

Uncertainty-Guided Inference-Time Depth Adaptation for Transformer-Based Visual Tracking

تقترح الورقة البحثية UncL-STARK، وهي طريقة حافظة للبنية للمتتبعات البصرية القائمة على المحولات، تعمل على تكييف عمق الاستدلال ديناميكيًا بناءً على تقديرات عدم اليقين المستمدة من خرائط حرارية لتحديد الزوايا، مما يقلل بشكل كبير من التكلفة الحسابية وزمن التأخير مع الحفاظ على دقة تتبع تضاهف أحدث المعاياي التقنية.

Patrick Poggi, Divake Kumar, Theja Tulabandhula, Amit Ranjan Trivedi2026-02-23