⚡ electrical engineering

Uncertainty in Real-Time Semantic Segmentation on Embedded Systems

تقترح هذه الورقة طريقة تجمع بين استخراج الميزات العميقة والانحدار البايزي وانتشار العزوم لتمكين التجزئة الدلالية في الوقت الفعلي والمدركة لعدم اليقين على الأنظمة المدمجة محدودة الموارد مع الحفاظ على الأداء التنبؤي.

Ethan Goan, Clinton Fookes2026-04-07
💻 computer science

Polarimetric Imaging for Perception

تُثبت هذه الورقة أن دمج استقطاب الضوء في الكاميرات الملونة (RGB) المستقطبة يحسن بشكل كبير من تقدير العمق أحادي الرؤية وكشف المساحات الحرة للقيادة الذاتية، مدعوماً بتقديم مجموعة بيانات شاملة جديدة وتغييرات معمارية طفيفة في الشبكات العصبية العميقة.

Michael Baltaxe, Tomer Pe'er, Dan Levi2026-04-07
⚡ electrical engineering

Ray-driven Spectral CT Reconstruction Based on Neural Base-Material Fields

تقترح هذه الورقة طريقة مبتكرة لإعادة بناء التصوير المقطعي المحوسب الطيفي تستخدم تمثيل المجال العصبي لتمثيل المواد الأساسية المستمرة، وتوظف نهج التجزئة القائم على الأشعة مع التفاضل التلقائي لحل مشكلة العكس غير محددة المعالم، مما يحقق تصويراً عالي الدقة دون التقيد بحدود الدقة المكانية التقليدية.

Ligen Shi, Ping Yang, Chang Liu, Wei Zhang, Xing Zhao, Jun Qiu2026-04-07
💻 computer science

Advancing Pre-trained Teacher: Towards Robust Feature Discrepancy for Anomaly Detection

تقترح هذه الورقة البحثية إطار عمل AAND، وهو إطار عمل ثنائي المراحل للكشف عن الشذوذ الصناعي يعمل على تعزيز تباين الميزات بين نموذجي المعلم والطالب المدربين مسبقاً من خلال توظيف وحدة تضخيم الشذوذ المتبقي لتقوية تمثيل الشذوذ، ومرحلة تقطير عكسي مع فقدان تقطير المعرفة الصلبة لتحسين إعادة بناء الأنماط الطبيعية، محققاً أداءً هو الأفضل في فئته على العديد من المعايير المرجعية.

Canhui Tang, Sanping Zhou, Yizhe Li, Yonghao Dong, Le Wang2026-04-07
💻 computer science

SketchDeco: Training-Free Latent Composition for Precise Sketch Colourisation

تُعد SketchDeco طريقةً لا تتطلب تدريباً تُمكّن من تلوين الرسومات بدقة عبر الجمع بين عملية عكس الانتشار (diffusion inversion) لتطبيق الألوان في مناطق محددة وآلية انتباه ذاتي مخصصة لتحقيق التناغم العالمي، مما يسمح للفنانين بتحقيق نتائج بجودة احترافية باستخدام أقنعة ولوحات ألوان بسيطة دون الحاجة إلى ضبط دقيق للنموذج.

Chaitat Utintu, Yi-Zhe Song2026-04-07
💻 computer science

Scalable and Generalizable Correspondence Pruning via Geometry-Consistent Pre-training

تقدم هذه الورقة بحثًا حول GeneralPruner، وهو أسلوب قابل للتوسع والتعميم لتقليم الارتباطات (correspondence pruning)، يستخدم نموذج تدريب مسبق متسق هندسيًا مع إعادة بناء النقاط الصحيحة المحجوبة ومشفر ثنائي المسار موحد للتغلب على تداخل القيم المتطرفة وتحسين الأداء بشكل كبير في تقدير وضع الكاميرا، والتحديد الموضعي البصري، والتسجيل ثلاثي الأبعاد.

Tangfei Liao, Xiaoqin Zhang, Tao Wang, Hao Ye, Min Li, Guobao Xiao, Mang Ye2026-04-07
🤖 AI

VLBiasBench: A Comprehensive Benchmark for Evaluating Bias in Large Vision-Language Model

يقدم هذا البحث VLBiasBench، وهو معيار شامل يتميز بمجموعة بيانات واسعة النطاق تضم أكثر من 128,000 عينة موزعة على 11 فئة من فئات الانحياز وتنسيقات أسئلة متنوعة، صُممت لتقييم وكشف الانحيازات الاجتماعية بدقة في كل من نماذج اللغة والرؤية الكبيرة مفتوحة المصدر ومغلقة المصدر.

Sibo Wang, Xiangkui Cao, Jie Zhang, Zheng Yuan, Shiguang Shan, Xilin Chen, Wen Gao2026-04-07
💻 computer science

Pose-dIVE: Pose-Diversified Augmentation with Diffusion Model for Person Re-Identification

يُعد Pose-dIVE إطار عمل مبتكر لتعزيز البيانات يستفيد من نموذج انتشار مشروط بوضعيات جسم بشري قائمة على نموذج SMPL وزوايا رؤية الكاميرا لتوليد عينات تدريب متنوعة، مما يقلل من تحيزات الوضعية وزاوية الرؤية ويعزز قدرة نماذج إعادة تحديد هوية الأشخاص على التعميم.

Inès Hyeonsu Kim, Woojeong Jin, Soowon Son, Junyoung Seo, Seokju Cho, JeongYeol Baek, Byeongwon Lee, JoungBin Lee, Seung (…)2026-04-07
💬 NLP

Document Parsing Unveiled: Techniques, Challenges, and Prospects for Structured Information Extraction

تقدم هذه الدراسة مراجعة شاملة لأبحاث تحليل المستندات من خلال اقتراح تصنيف يميز بين أنظمة المسارات النمطية (modular pipeline systems) ونهج نماذج الرؤية واللغة الموحدة (unified Vision-Language Model approaches)، مع تفصيل المكونات الرئيسية، ومعايير التقييم، والتحديات المستقبلية في بناء أنظمة ذكاء مستندات قوية.

Qintong Zhang, Bin Wang, Victor Shea-Jay Huang, Junyuan Zhang, Zhengren Wang, Hao Liang, Conghui He, Wentao Zhang2026-04-07
📊 statistics

An Analytical Theory of Spectral Bias in the Learning Dynamics of Diffusion Models

تؤسس هذه الورقة إطاراً تحليلياً يكشف أن نماذج الانتشار تظهر انحيازاً طيفياً عالمياً عكسياً للتباين، حيث يتم تعلم الهياكل عالية التباين بشكل أسرع بكثير من التفاصيل الدقيقة، بينما تُظهر أن الالتفاف المحلي في شبكات (U-Nets) يغير هذه الديناميكية نوعياً لتمكين الظهور شبه المتزامن لأنماط متعددة.

Binxu Wang, Cengiz Pehlevan2026-04-07