💻 computer science

Typography-Based Monocular Distance Estimation Framework for Vehicle Safety Systems

تقدم هذه الورقة إطار عمل منخفض التكلفة لتقدير المسافة أحادي العين في الوقت الفعلي لأنظمة سلامة المركبات، والذي يستفيد من طباعة لوحات الترخيص القياسية كعلامات مرجعية سلبية لتحقيق قياس متري عالي الدقة بمتوسط خطأ مطلق قدره 7.7%، متفوقاً بذلك على طرق عرض اللوحة من خلال تقليل تباين التقدير بشكل كبير دون الحاجة إلى تسريع وحدة معالجة الرسومات.

Manognya Lokesh Reddy, Zheng Liu2026-03-25
🤖 machine learning

Exposure-Normalized Bed and Chair Fall Rates via Continuous AI Monitoring

تشير هذه الدراسة الاستعادية للأتراب، التي استخدمت مراقبة مستمرة بالذكاء الاصطناوي، إلى أن معدلات السقوط المُعدلة حسب التعرض أعلى في الكراسي منها في الأسرّة، مع تحديد إخفاقات محددة في وضعية مسند القدم كعامل خطر رئيسي، مما يدعم الفرضية القائلة بأن تحسين سلامة الكراسي بدلاً من تقليل استخدامها قد يكون استراتيجية أكثر فعالية للوقاية من السقوط.

Paolo Gabriel, Peter Rehani, Zack Drumm, Tyler Troy, Tiffany Wyatt, Narinder Singh2026-03-25
💻 computer science

It Takes Two: A Duet of Periodicity and Directionality for Burst Flicker Removal

تقدم هذه الورقة Flickerformer، وهي بنية قائمة على المحولات (transformer) تعمل بفعالية على إزالة عيوب الوميض المتفجر من خلال الاستفيد من دوريتها واتجاهيتها الجوهرية عبر وحدة دمج قائمة على الطور، وشبكة تغذية أمامية ذات ارتباط ذاتي، ووحدة انتباه اتجاهية قائمة على المويجات (wavelet).

Lishen Qu, Shihao Zhou, Jie Liang, Hui Zeng, Lei Zhang, Jufeng Yang2026-03-25
🤖 AI

Focus, Don't Prune: Identifying Instruction-Relevant Regions for Information-Rich Image Understanding

تقدم الورقة البحثية PinPoint، وهو إطار عمل مبتكر ثنائي المراحل يعزز كفاءة ودقة نماذج الرؤية واللغة الكبيرة على الصور الغنية بالمعلومات من خلال تحديد وتدقيق المناطق ذات الصلة بالتعليمات لتقليل العبء الحسابي الناتج عن الرموز البصرية غير ذات الصلة.

Mincheol Kwon, Minseung Lee, Seonga Choi, Miso Choi, Kyeong-Jin Oh, Hyunyoung Lee, Cheonyoung Park, Yongho Song, Seunghy (…)2026-03-25
🤖 AI

TDATR: Improving End-to-End Table Recognition via Table Detail-Aware Learning and Cell-Level Visual Alignment

إن TDATR هو إطار عمل للتعرف على الجداول من طرف إلى طرف يعتمد استراتيجية "الإدراك ثم الدمج"، حيث يجمع بين التعلم المدرك لتفاصيل الجدول تحت نموذج لغوي مع وحدة تحديد مواقع الخلايا الموجهة بالهيكل لتحقيق أداء رائد في سبعة معايير قياسية مع التعامل بفعالية مع السيناريوهات ذات البيانات المحدودة.

Chunxia Qin, Chenyu Liu, Pengcheng Xia, Jun Du, Baocai Yin, Bing Yin, Cong Liu2026-03-25
💻 computer science

Cross-Slice Knowledge Transfer via Masked Multi-Modal Heterogeneous Graph Contrastive Learning for Spatial Gene Expression Inference

تقترح الورقة البحثية نموذج SpaHGC، وهو نموذج رسوم بيانية غير متجانسة متعدد الوسائط يستفيد من التعلم التبايني المقنع ونقل المعرفة عبر الشرائح من النماذج التأسيسية لعلم الأمراض لتحسين دقة وملاءمة الاستدلال البيولوجي للتعبير الجيني المكاني من الصور النسيجية بشكل كبير.

Zhiceng Shi, Changmiao Wang, Jun Wan, Wenwen Min2026-03-25
💻 computer science

MVRD-Bench: Multi-View Learning and Benchmarking for Dynamic Remote Photoplethysmography under Occlusion

تقدم هذه الورقة مجموعة بيانات MVRD وإطار عمل MVRD-rPPG، وهو نهج تعلم متعدد الرؤى مبتكر يستفيد من مقاطع فيديو متعددة الزوايا ومتزامنة ووحدات متقدمة مثل التعويض الزمني التكيفي والانتباه المدرك للارتباط لتحقيق تقدير قوي لإشارات قياس تغير حجم الدم عن بُعد (rPPG) في ظل ظروف الحركة والانسداد الصعبة.

Zuxian He, Xu Cheng, Zhaodong Sun, Haoyu Chen, Jingang Shi, Xiaobai Li, Guoying Zhao2026-03-25
🤖 AI

UniQueR: Unified Query-based Feedforward 3D Reconstruction

يقدم UniQueR إطار عمل موحداً يعتمد على الاستعلام للتغذية الأمامية، يقوم بإعادة بناء مشاهد ثلاثية الأبعاد كاملة من صور غير محددة الوضعية في تمريرة واحدة عبر استنتاج نقاط مرساة ثلاثية الأبعاد متفرقة لنمذجة الهندسة المرئية والمحجوبة على حد سواء، محققاً جودة رندر ودقة هندسية فائقتين بتكاليف حوسبة أقل بكثير من الطرق الحالية كثيفة الـ 2.5D.

Chensheng Peng, Quentin Herau, Jiezhi Yang, Yichen Xie, Yihan Hu, Wenzhao Zheng, Matthew Strong, Masayoshi Tomizuka, Wei (…)2026-03-25
💻 computer science

ForeSea: AI Forensic Search with Multi-modal Queries for Video Surveillance

تقدم هذه الورقة نظام ForeSea، وهو نظام بحث جنائي يعتمد على الذكاء الاصطناعي يتميز بمسار عمل ثلاثي المراحل لاسترجاع وتفسير الفيديو متعدد الوسائط، إلى جانب ForeSeaQA، وهو أول معيار اختبار مصمم لتقييم الاستعلامات المعقدة التي تجمع بين الصور والنصوص مع تحديد زمني دقيق في لقطات المراقبة طويلة المدى.

Hyojin Park, Yi Li, Janghoon Cho, Sungha Choi, Jungsoo Lee, Taotao Jing, Shuai Zhang, Munawar Hayat, Dashan Gao, Ning Bi (…)2026-03-25
🤖 machine learning

FixationFormer: Direct Utilization of Expert Gaze Trajectories for Chest X-Ray Classification

تقدم الورقة البحثية FixationFormer، وهي بنية قائمة على المحولات (transformer) تدمج مسارات نظرات الخبراء مباشرة كرموز تسلسلية لتحقيق أداء رائد في تصنيف صور الأشعة السينية للصدر من خلال نمذجة البنية الزمنية والمكانية لحركات العين التشخيصية جنباً إلى جنب مع ميزات الصورة بشكل فعال.

Daniel Beckmann, Benjamin Risse2026-03-25