💻 computer science

HeatCast: A Benchmark for Neighborhood-Scale LST Forecasting across 124 U.S. Cities

تقدم الورقة البحثية HeatCast، وهو معيار مرجعي شامل للتنبؤ بدرجة حرارة سطح الأرض الشهرية على نطاق الأحياء (30 مترًا) عبر 124 مدينة أمريكية، يتضمن مجموعة بيانات واسعة النطاق، ومقاييس تقييم موحدة، ويُظهر الأداء المتفوق لنموذج Earthformer على نماذج CNN+LSTM المرجعية.

Jesus Guerrero, Isaac Corley, Leon Najafirad, Maryam Tabar, Paul Rad2026-08-11
🤖 machine learning

Data collection from highways: a geometric, class-agnostic approach to embedded vehicle counting

تقترح هذه الورقة مساراً هندسياً بحتاً لاستشعار حركة المرور، غير مرتبط بفئة معينة، للأجهزة المدمجة، يحقق عدّاً للمركبات وتقديراً للسرعة في الوقت الفعلي دون استخدام نماذج التعلم العميق، مما يظهر دقة وكفاءة متفوقتين على النماذج المرجعية للتتبع في عمليات النشر الميداني، مع تسليط الضوء على القيود الهندسية الحرجة لتطبيقات الحافة.

Lucas Gouveia Omena Lopes, William W. M. Lira, Alexandre M. Lima, Thales M. A. Vieira2026-08-11
💬 NLP

Keep It Simple: Multi-Key Episodic Memory Retrieval for Ultra-Long Video Understanding

تقترح الورقة البحثية إطار عمل MERIT، وهو إطار بسيط وفعال لفهم الفيديو فائق الطول يعطي الأولوية لبناء ذاكرة حلقية (episodic memory) ذات استدعاء عالٍ باستخدام تمثيلات متعددة المفاتيح، ويؤجل الاستدلال الدلالي المعقد إلى وقت الاستنتاج من خلال التوسع الزمني عند الطلب، محققاً أداءً هو الأفضل في فئته دون العبء الحسابي لنمذجة العلاقات العالمية مسبقاً.

Yeeun Choi, Youngbeom Yoo, Joon-Young Lee, Hyolim Kang, Seon Joo Kim2026-08-11
🤖 machine learning

Tokenizer Generator Coupling in Medical Image Generation

تُثبت هذه الورقة أنه في توليد الصور الطبية، يكون المرمز (tokenizer)، والمولد (generator)، وأخذ العينات (sampler) الأمثل مترابطين بشكل وثيق بدلاً من كونهم مستقلين، مما يستلزم استراتيجية اختيار مشتركة واستخدام إحصائية جديدة خالية من المولد للتنبؤ بدقة بجودة التوليد اللاحقة بما يتجاوز مقاييس إعادة البناء التقليدية.

Liam Chalcroft2026-08-11
💻 computer science

Vision Meets WiFi: Physics-Grounded Estimation of Volumetric Mechanical Properties

تقدم الورقة البحثية ViWi، وهو إطار عمل متمحور حول الأجسام يجمع بين الميزات البصرية والواصفات الكهرومغناطيسية القائمة على الـ WiFi لحل الغموض البصري وتقدير الخصائص الميكانيكية الحجمية بدقة من خلال نمذجة الأجسام كفتحات مادية متماسكة بدلاً من كونها فوكسلات مستقلة.

Ali Bahri, Hongliang Li, Soufiane Lamghari, Jie Chuai, Zhitang Chen2026-08-11
💻 computer science

Ghost Features and Spooky Transfer Learning for Hypercomplex-Valued Neural Networks

تقدم هذه الورقة طريقة لبناء شبكات عصبية ذات قيم فائقة التعقيد تولد "ميزات شبحية" من المكونات التخيلية لإثراء معلومات النموذج، والتي يمكن دمجها بكفاءة في النماذج الحالية عبر نهج "تعلم نقل شبحي" مبتكر.

Guilherme Vieira Neto, Marcos Eduardo Valle2026-08-11
💻 computer science

BRUCE: Benchmarking Robustness Under Corruption Escalation for Scientific Vision-Language Reasoning

تقدم هذه الورقة BRUCE، وهو إطار عمل مبتكر يقيس مدى متانة نماذج الرؤية واللغة العلمية ضد فساد الصور المتصاعد من خلال توظيف مقاييس جديدة لتقدير تدهور الأداء وتقديم تحليل تفسيري لإخفاقات الاستنتاج عبر المجالات المتعلقة بالتعرف الضوئي على الحروف (OCR)، والمجال المكاني، والرمزي، والدلالي.

Saim Rehman, Muhammad Shafique2026-08-11
🤖 AI

Multi-Task Consistency-based Detection of Adversarial Attacks

تقترح هذه الورقة البحثية مخططاً فعالاً للكشف عن الهجمات العدائية في القيادة الذاتية يستفيد من مقياس درجة الاتساق لتحديد أوجه عدم الاتساق بين مخرجات الرؤية متعددة المهام، محققةً معدل كشف بنسبة 99.9% لمساحة تحت منحنى خصائص تشغيل المستقبِل (ROC-AUC) ضد هجمات التدرج المتدرج المعتمد على إسقاط التدرج (PGD) على مجموعة بيانات BDD100k.

Cong Chen, Jean-Philippe Monteuuis, Jonathan Petit2026-08-11
💻 computer science

XClipGS: Exact Half-Space Clipping for Medical Volume Gaussian Splatting

يقدم XClipGS عامل قص نصف فضاء دقيق وقابل للتفاضل لتقنية Gaussian Splatting الخاصة بالأحجام الطبية، والذي يقوم بتحليل تكامل الشعاع تحت نموذج تقريبي محلي لتمكين التصيير عالي الدقة والوقت الحقيقي لمستويات القص التعسفية مع الإشراف الفعال وتقليل تسرب التشريح الداخلي المخفي.

Zhongpai Gao, Benjamin Planche, Meng Zheng, Anwesa Choudhuri, Chaoyi Zhou, Terrence Chen, Ziyan Wu2026-08-11
💻 computer science

DINO-3DRA: Leveraging 2D Foundation Model Semantics for 3D Cerebral Aneurysm Segmentation

يُعد DINO-3DRA إطار عمل ثنائي المسار مبتكرًا يستفيد من ميزات نموذج التأسيس ثنائي الأبعاد المجمد (DINOv3) التي يتم حقنها في شبكة U-Net ثلاثية الأبعاد عبر الخلط المكاني والدمج المتبقي لتحقيق تقسيم متطور وقوي لتمدد الأوعية الدموية الدماغية في تصوير الأوعية الدموية ثلاثي الأبعاد (3DRA) من خلال التغلب على عدم توازن الفئات والحفاظ على الاستمرارية التشريحية دون الحاجة إلى تدريب مسبق واسع النطاق ثلاثي الأبعاد.

Jiayang Lu, Fengming Lin, Alejandro F. Frangi, Ali Sarrami-Foroushani2026-08-11