💻 computer science

Radiometric fingerprinting of object surfaces using mobile laser scanning and semantic 3D road space models

تقترح هذه الورقة طريقة لتوليد بصمات إشعاعية للأسطح الحضرية من خلال تجميع ملاحظات ليدار (LiDAR) من حملات مسح متنقلة متعددة وربطها بنموذج مدينة ثلاثي الأبعاد ذي دلالات ومعلومات عالية الدقة، مما يتيح الاستخراج التلقائي للأنماط الخاصة بالمواد لتعزيز التوائم الرقمية الحضرية.

Benedikt Schwab, Thomas H. Kolbe2026-03-13
💻 computer science

InstantHDR: Single-forward Gaussian Splatting for High Dynamic Range 3D Reconstruction

تقترح الورقة البحثية InstantHDR، وهي شبكة تغذية أمامية تتيح إعادة بناء مشاهد ثلاثية الأبعاد ذات نطاق ديناميكي عالٍ من صور متعددة التعريض غير معايرة ذات نطاق ديناميكي منخفض في تمريرة واحدة، محققةً جودة تركيب هي الأفضل في فئتها مع سرعات استدلال أسرع بكثير مقارنة بالطرق القائمة على التحسين الحالية.

Dingqiang Ye, Jiacong Xu, Jianglu Ping, Yuxiang Guo, Chao Fan, Vishal M. Patel2026-03-13
💻 computer science

Hierarchical Granularity Alignment and State Space Modeling for Robust Multimodal AU Detection in the Wild

تقترح هذه الورقة إطار عمل جديداً متعدد الوسائط للكشف القوي عن وحدات الحركة الوجهية في البيئات الواقعية، يدمج النماذج التأسيسية (DINOv2 وWavLM) مع وحدة محاذاة الحبيبية الهرمية وبنية Vision-Mamba لالتقاط التحولات الدلالية دقيقة التفاصيل والاعتمادات الزمنية فائقة الطول بفعالية، محققاً أداءً هو الأفضل في حالته على مجموعة بيانات Aff-Wild2.

Jun Yu, Yunxiang Zhang, Naixiang Zheng, Lingsi Zhu, Guoyuan Wang2026-03-13
💻 computer science

UniCompress: Token Compression for Unified Vision-Language Understanding and Generation

تقترح هذه الورقة البحثية UniCompress، وهو إطار عمل لضغط الرموز (tokens) يتميز بخفته ونمطيته، ويستخدم رموزاً ميتا عالمية قابلة للتعلم لتقليل عدد الرموز البصرية بشكل كبير في نماذج الرؤية واللغة الموحدة، مما يؤدي إلى خفض العبء الحسابي وتمكين النشر الفعال في السيناريوهات ذات الموارد المحدودة مع الحفاظ على أداء عالٍ في مهام الفهم والتوليد على حد سواء.

Ziyao Wang, Chen Chen, Jingtao Li, Weiming Zhuang, Jiabo Huang, Ang Li, Lingjuan Lyu2026-03-13
💻 computer science

UNet-AF: An alias-free UNet for image restoration

تقترح الورقة البحثية UNet-AF، وهي بنية UNet جديدة خالية من التزييف (alias-free) تستبدل الطبقات التقليدية بمكونات متطورة متكافئة تحت الإزاحة (translation-equivariant) لتحسين التكافؤ تحت الإزاحة بشكل كبير مع الحفاظ على أداء تنافسي في مهام ترميم الصور.

Jérémy Scanvic, Quentin Barthélemy, Julián Tachella2026-03-13
💻 computer science

Learning to Assist: Physics-Grounded Human-Human Control via Multi-Agent Reinforcement Learning

تقدم هذه الورقة AssistMimic، وهو إطار عمل للتعلم التعزيزي متعدد الوكلاء يُمكّن الروبوتات البشرية من المساعدة والتفاعل جسدياً مع البشر من خلال التدريب المشترك لسياسات مدركة للشريك، وتهيئتها باستخدام أولويات حركة بشرية واحدة، وتوظيف إعادة استهداف مرجعي ديناميكي للتكيف مع الديناميكيات البشرية في الوقت الفعلي.

Yuto Shibata, Kashu Yamazaki, Lalit Jayanti, Yoshimitsu Aoki, Mariko Isogawa, Katerina Fragkiadaki2026-03-13
💻 computer science

DriveXQA: Cross-modal Visual Question Answering for Adverse Driving Scene Understanding

تقدم هذه الورقة DriveXQA، وهي مجموعة بيانات متعددة الوسائط شاملة لفهم مشاهد القيادة في الظروف المعاكسة، وتقترح MVX-LLM، وهي بنية مبتكرة ذات جهاز عرض انتباه متقاطع مزدوج يعمل بفعالية على دمج الوسائط المرئية المتعددة لتعزيز الأداء في الظروف الصعبة مثل أعطال المستشعرات والضباب.

Mingzhe Tao, Ruiping Liu, Junwei Zheng, Yufan Chen, Kedi Ying, M. Saquib Sarfraz, Kailun Yang, Jiaming Zhang, Rainer Sti (…)2026-03-13
💻 computer science

DeepHistoViT: An Interpretable Vision Transformer Framework for Histopathological Cancer Classification

تقترح الورقة البحثية DeepHistoViT، وهو إطار عمل لنموذج "Vision Transformer" قابل للتفسير، يحقق دقة هي الأفضل في فئتها في تصنيف الصور النسيجية لسرطان الرئة، وسرطان القولون، والسرطان الليمفاوي الحاد، مع توفير تحديد للمواقع بناءً على الانتباه لدعم اتخاذ القرار السريري.

Ravi Mosalpuri, Mohammed Abdelsamea, Ahmed Karam Eldaly2026-03-13
💻 computer science

Real-time Rendering-based Surgical Instrument Tracking via Evolutionary Optimization

تقدم هذه الورقة إطار عمل لتتبع الأدوات الجراحية في الوقت الفعلي يستفيد من خوارزمية تطور اختيار (CMA-ES) والتحسين بالرندرة الدفعية لتقدير الوضعية وتكوينات المفاصل بشكل مشترك، محققةً دقة وكفاءة فائقتين في الظروف البصرية الصعبة مقارنة بالطرق السابقة.

Hanyang Hu, Zekai Liang, Florian Richter, Michael C. Yip2026-03-13
💻 computer science

Stay in your Lane: Role Specific Queries with Overlap Suppression Loss for Dense Video Captioning

تقترح هذه الورقة إطار عمل جديد للوصف الكثيف للفيديو يستخدم استعلامات محددة الأدوار مع فقدان كبت التداخل والمحاذاة التباينية للتخفيف من التداخل متعدد المهام والتكرار الزمني، مما يحقق تحديداً أكثر دقة للأحداث وأوصافاً غنية دلالياً.

Seung Hyup Baek, Jimin Lee, Hyeongkeun Lee, Jae Won Cho2026-03-13