💻 computer science

BROTHER: Behavioral Recognition Optimized Through Heterogeneous Ensemble Regularization for Ambivalence and Hesitancy

تقترح هذه الورقة BROTHER، وهو إطار عمل متعدد الوسائط عالي الانتظام يستخدم تحسين سرب الجسيمات لدمج مصنفات متنوعة تعتمد على سمات بصرية وصوتية ولغوية إحصائية متخصصة، محققاً ذروة في مقياس Macro F1-score تبلغ 0.7465 في التعرف على الحالات السلوكية المعقدة للتردد والارتباك في مقاطع الفيديو الطبيعية.

Alexandre Pereira, Bruno Fernandes, Pablo Barros2026-03-17
💻 computer science

HomeGuard: VLM-based Embodied Safeguard for Identifying Contextual Risk in Household Task

تقدم الورقة البحثية HomeGuard، وهو نظام حماية يعتمد على نماذج الرؤية واللغة الكبيرة (VLM)، يستخدم تسلسل الأفكار الموجه بالسياق والضبط الدقيق بالتعزيز لتحديد المخاطر المنزلية السياقية بدقة وتوليد قيود مكانية قابلة للتنفيذ، مما يحسن كشف السلامة بشكل كبير مع تقليل الإفراط في الحماية مقارنة بالطرق الحالية.

Xiaoya Lu, Yijin Zhou, Zeren Chen, Ruocheng Wang, Bingrui Sima, Enshen Zhou, Lu Sheng, Dongrui Liu, Jing Shao2026-03-17
💻 computer science

Histo-MExNet: A Unified Framework for Real-World, Cross-Magnification, and Trustworthy Breast Cancer Histopathology

يُعد Histo-MExNet إطار عمل موحداً وموثوقاً للتعلم العميق يجمع بين بنية الخبراء المتعددين ذات البوابة، وتعلم النماذج الأولية، والتنظيم المستند إلى الفيزياء، لتحقيق تصنيف دقيق، وغير مرتبط بالمقياس، وقابل للتفسير لتشخيص سرطان الثدي في الصور النسيجية مع تحديد كمي لعدم اليقين.

Enam Ahmed Taufika, Md Ahasanul Arafatha, Abhijit Kumar Ghoshb, Md. Tanzim Rezab, Md Ashad Alamc2026-03-17
🤖 AI

Deep EM with Hierarchical Latent Label Modelling for Multi-Site Prostate Lesion Segmentation

تقترح هذه الورقة إطار عمل "توقع تعظيم هرمي" (HierEM) يعمل على نمذجة تعليقات آفات البروستاتا متعددة المواقع كأرصاد صاخبة لقناع نظيف كامن، وذلك بهدف تفسير التباين الخاص بكل موقع بشكل صريح، مما يؤدي إلى تحسين التعميم عبر المواقع بشكل كبير وتوفير تقديرات قابلة للتفسير لجودة التعليقات.

Wen Yan, Yipei Wang, Shiqi Huang, Natasha Thorley, Mark Emberton, Vasilis Stavrinides, Yipeng Hu, Dean Barratt2026-03-17
🤖 machine learning

Inclusive AI for Group Interactions: Predicting Gaze-Direction Behaviors in People with Intellectual and Developmental Disabilities

تُعزز هذه الورقة البحثية الذكاء الاصطناعي الشامل للتفاعلات الجماعية التي تشمل الأشخاص ذوي الإعاقات الذهنية والنمائية من خلال تقديم مجموعة بيانات MIDD، وتحليل الاختلافات في سلوك التحديق مقارنة بالفئات الطبيعية عصبياً، وتقييم نماذج تعلم الآلة جنباً إلى جنب مع رؤى المعالجين لتوجيه تطوير أدوات أكثر فعالية وتمركزاً حول الإنسان.

Giulia Huang, Maristella Matera, Micol Spitale2026-03-17
💻 computer science

Wi-Spike: A Low-power WiFi Human Multi-action Recognition Model with Spiking Neural Networks

يُعد Wi-Spike إطار عمل للشبكات العصبية النبضية المستوحاة بيولوجياً، والذي يستفيد من المعالجة القائمة على الأحداث وآلية انتباه زمني مبتكرة لتحقيق التعرف على الأفعال المتعددة بكفاءة عالية في استهلاك الطاقة وبأحدث التقنيات باستخدام معلومات حالة القناة لشبكات الواي فاي، مما يقلل استهلاك الطاقة بشكل كبير مع الحفاظ على دقة عالية.

Nengbo Zhang, Yao Ying, Lu Wang, Kaishun Wu, Jieming Ma, Fei Luo2026-03-17
🔭 astrophysics

Mapping Dark-Matter Clusters via Physics-Guided Diffusion Models

تقدم هذه الورقة نموذج انتشار موجه بالفيزياء ومؤتمت بالكامل، تم تدريبه على مجموعة بيانات DarkClusters-15k الجديدة لإعادة بناء توزيعات كتلة المادة المظلمة في العناقيد المجرية بسرعة ودقة من البيانات الرصدية، مما يوفر تقديرات لعدم اليقين جيدة المعايرة دون الحاجة إلى ضبط من قبل الخبراء.

Diego Royo, Brandon Zhao, Adolfo Muñoz, Diego Gutierrez, Katherine L. Bouman2026-03-17
🤖 machine learning

Trust-Region Noise Search for Black-Box Alignment of Diffusion and Flow Models

تقدم هذه الورقة البحثية خوارزمية "البحث عن الضجيج في منطقة الثقة" (Trust-Region Noise Search - TRS)، وهي خوارزمية تحسين للصندوق الأسود تعمل على مواءمة نماذج الانتشار والتدفق مع المكافآت المستهدفة من خلال تحسين عينات الضجيج المصدرية بكفاءة، محققةً أداءً فائقاً عبر مهام تحويل النص إلى صورة، وتصميم الجزيئات، وتصميم البروتينات، دون الحاجة إلى مكافآت قابلة للاشتقاق أو ضبط مكثف للمعلمات الفائقة.

Niklas Schweiger, Daniel Cremers, Karnik Ram2026-03-17
💻 computer science

LatSearch: Latent Reward-Guided Search for Faster Inference-Time Scaling in Video Diffusion

تقدم هذه الورقة البحثية LatSearch، وهو إطار عمل فعال لتوسيع نطاق الاستدلال في نماذج الانتشار بالفيديو، والذي يستخدم نموذج مكافأة كامن مبتكر لتوجيه عمليات إعادة أخذ العينات والتقليم أثناء عملية إزالة الضجيج، مما يتغلب على القيود الحسابية وقيود الإشارة لطرق تحسين الضجيج السابقة لتحسين جودة توليد الفيديو والقدرة على التحكم بشكل كبير.

Zengqun Zhao, Ziquan Liu, Yu Cao, Shaogang Gong, Zhensong Zhang, Jifei Song, Jiankang Deng, Ioannis Patras2026-03-17
🤖 machine learning

ASAP: Attention-Shift-Aware Pruning for Efficient LVLM Inference

تقدم هذه الورقة البحثية ASAP، وهي طريقة تقليم خالية من التدريب ومتوافقة مع ذاكرة التخزين المؤقت للمفاتيح والقيم (KV-Cache)، تعمل على تخفيف ظاهرة "انزياح الانتباه" وتقليل تكرار الرموز المرئية من خلال القناع الديناميكي والدمج الناعم الموزون، مما يحقق انخفاضًا بنسبة 80% في العمليات الحسابية (FLOPs) مع فقدان ضئيل في الأداء في النماذج اللغوية البصرية الكبيرة.

Surendra Pathak, Bo Han2026-03-17