💻 computer science

GeRaF: Neural Geometry Reconstruction from Radio Frequency Signals

تُعد GeRaF طريقة تعلم ضمني عصبي مبتكرة تحقق إعادة بناء هندسي ثلاثي الأبعاد بدقة مليمترية من إشارات الترددات الراديوية عبر تقديم عملية رندر قائمة على المرشحات، ومسار حجمي قائم على الفيزياء، واستراتيجيات أخذ عينات عديمة العدسات للتغلب على تحديات الانسداد والضجيج والتعقيد التكعيبي المتأصل في التصوير الراديوي عديم العدسات.

Jiachen Lu, Hailan Shanbhag, Haitham Al Hassanieh2026-05-29
💻 computer science

Seeing through boxes: Non-Line-of-Sight 3D Reconstruction from Radar Signals

تقدم هذه الورقة البحثية GeRaF 2.0، وهو إطار عصبي موحد يستفيد من هندسة خط البصر المرئية لتوجيه وتثبيت إعادة بناء المشاهد ثلاثية الأبعاد المخفية من إشارات التردد اللاسلكي المشوشة، محققاً أداءً هو الأفضل في مجاله في التصوير غير المباشر (Non-Line-of-Sight).

Jiachen Lu, Hailan Shanbhag, Haitham Al Hassanieh2026-05-29
💻 computer science

Eulerian Gaussian Splatting using Hashed Probability Pyramids

تقدم هذه الورقة البحثية "Eulerian Gaussian Splatting"، وهو إطار عمل لمجال الإشعاع الاحتمالي يستبدل التلاعب الكثيف بالمعايير التجريبية (heuristic) بتحسين قائم على التدرج لكثافة احتمالية حجمية قابلة للتعلم باستخدام أهرامات احتمالية مُجزأة (hashed probability pyramids)، مما يحقق جودة إعادة بناء رائدة في mip-NeRF 360 مع الحفاظ على سرعة رندرة بمستوى 3DGS.

Mia Gaia Polansky, George Kopanas, Stephan Garbin, Todd Zickler, Dor Verbin2026-05-29
💻 computer science

Guidance Contrastive Token Credit Assignment for Discrete Policy Optimization

تقدم هذه الورقة البحثية "تحسين السياسة التبايني التوجيهي" (GCPO)، وهو خوارزمية مبتكرة تعمل على تحسين تعلم السياسات المنفصلة من خلال استبدال تخصيص الائتمان الموحد على مستوى العينة بمزايا دقيقة على مستوى الرمز (token) مستمدة من تباين تنبؤات النموذج تحت المطالبات الإيجابية والسلبية، مما يحقق أداءً فائقاً في مهام توليد الصور من النصوص ومهام سلسلة الأفكار مقارنة بالطرق الحالية مثل GRPO وDAPO.

Shufan Li, Konstantinos Kallidromitis, Akash Gokul Yusuke Kato, Kazuki Kozuka, Aditya Grover2026-05-29
💻 computer science

Towards the automated segmentation of epicardial and mediastinal fats: A multi-manufacturer approach using intersubject registration and random forest

تقترح هذه الورقة طريقة مؤتمتة بالكامل ومتعددة الشركات المصنعة باستخدام التسجيل بين الأفراد وتصنيف الغابة العشوائية لتقسيم الدهون فوق الشغاف والدهون المنصفية في صور الأشعة المقطعية لتصوير الكالسيوم التاجي، محققة دقة عالية (98.4%) ومؤشر تشابه دايس يبلغ 96.8%.

É. O. Rodrigues, A. Conci, F. F. C. Morais, M. G. Pérez2026-05-29
💻 computer science

Motion-guided sparse correction enables expert-quality point tracking across diverse microscopy regimes

تقدم الورقة البحثية RIPPLE، وهي أداة تصحيح متفرقة موجهة بالحركة تتيح تتبع النقاط بجودة الخبراء في فيديوهات المجهر المتنوعة من خلال السماح للمستخدمين بتحسين المسارات الآلية بأقل قدر من التدخل اليدوي، مما يقلل بشكل كبير من جهد التوسيم مع الحفاظ على دقة عالية.

Leonidas Zimianitis, Pasindu Thenahandi, Kai Buckhalter, Dineth Jayakody, Julian O. Kimura, Xinyue Liang, Karen Cunningh (…)2026-05-29
💻 computer science

An Approach for Thyroid Nodule Analysis Using Thermographic Images

تقدم هذه الورقة مشروعاً تجريبياً يراجع التصوير الحراري لتحليل الغدة الدرقية، ويقترح بروتوكولات للحصول على الصور والتسجيل الذاتي، ويحدد إطاراً لاستخراج الميزات والتصنيف لدعم الكشف المبكر عن عقد الغدة الدرقية في بيئة مستشفى جامعي.

J. R. González, É. O. Rodrigues, C. P. Damião, C. A. P. Fontes, A. C. Silva, A. C. Paiva, H. Li, C. Du, A. Conci2026-05-29
💻 computer science

Deep Psychovisual Image Representations

تقدم هذه الورقة "الترميز البصري العميق" (Deep Visual Coding)، وهو إطار عمل للتعلم العميق مستوحى من الرؤية النفسية البصرية يستخدم تمثيلات مُتعلمة في النطاق الترددي والقيم المركبة لإنشاء نماذج رؤية أكثر قابلية للتفسير، ومستقلة عن العمق، وأكثر كفاءة مقارنة بالشبكات العصبية الالتفافية التقليدية (CNNs).

Wendi Ma, Aryaman Sharma, Wei Dai, Shekhar S. Chandra2026-05-29
💻 computer science

UniNote: A Unified Embedding Model for Multimodal Representation and Ranking

يُعد UniNote نموذج تضمين موحداً صُمم لتحسين استرجاع العناصر من عنصر إلى آخر في النطاق الصناعي عبر توظيف نموذج تدريب ثنائي المراحل يتكون من الضبط الدقيق الخاضع للإشراف والتعلم التعزيزي للموازنة بين التمثيل العالمي والترتيب دقيق التفاصيل، محققاً بذلك أداءً رائداً وكفاءة في التكلفة في عمليات النشر واسعة النطاق في Xiaohongshu.

Jinghan Zhao, Wenwei Jin, Anqi Li, Jintao Tong, Luya Mo, Jiawei Li, Bin Li, Yao Hu2026-05-29
💻 computer science

ViASNet: A Video Ad Saliency Network for Predicting Dynamic Saliency and Viewer Engagement

تقدم هذه الورقة البحثية ViASNet، وهو نموذج للتعلم العميق يعتمد على بنية 3D U-Net يدمج الإشارات الصوتية والدلالية للتنبؤ بخرائط البروز الديناميكية لإعلانات الفيديو قصيرة المدى، مما يثبت قدرته على تحسين تصميم الإعلانات وتحديد المحتوى غير الجذاب من خلال التحقق عبر تتبع حركة العين والتشخيص القائم على الإنتروبيا.

Jianping Ye, Michel Wedel2026-05-29