⚡ electrical engineering

SALIENT: Frequency-Aware Paired Diffusion for Controllable Long-Tail CT Detection

يُعد SALIENT إطار عمل انتشار يعتمد على نطاق المويجات (wavelet-domain) ومشروط بالقناع، يقوم بتخليق أحجام مقترنة من الآفات والأقنعة لتمكين التعزيز القابل للتحكم وذو الكفاءة الحسابية، مما يحسن بشكل كبير من الدقة في اكتشاف الآفات النادرة ذات التوزيع المحدود (long-tail) في فحوصات الأشعة المقطعية لكامل الجسم.

Yifan Li, Mehrdad Salimitari, Taiyu Zhang, Guang Li, David Dreizin2026-03-02
⚡ electrical engineering

SegReg: Latent Space Regularization for Improved Medical Image Segmentation

تقدم الورقة البحثية SegReg، وهو إطار عمل لتنظيم الفضاء الكامن متوافق مع بنيات U-Net يعزز أداء تعميم النطاق والتعلم المستمر في تقسيم الصور الطبية من خلال هيكلة تضمينات الميزات دون إضافة معاملات أو عبء إضافي على الذاكرة.

Puru Vaish, Amin Ranem, Felix Meister, Tobias Heimann, Christoph Brune, Jelmer M. Wolterink2026-03-02
💻 computer science

LE-NeuS: Latency-Efficient Neuro-Symbolic Video Understanding via Adaptive Temporal Verification

يُعد LE-NeuS إطار عمل عصبي-رمزي كفؤ من حيث زمن الاستجابة للإجابة على الأسئلة المتعلقة بالفيديوهات طويلة التنسيق، حيث يحقق تقليلاً كبيراً في زمن استجابة الاستدلال (من 90 ضعفاً إلى حوالي 10 أضعاف مقارنة بنماذج الرؤية واللغة الأساسية) مع الحفاظ على مكاسب الدقة من خلال أخذ عينات إطارية تكيفية موجهة بواسطة CLIP وكشف القضايا المجمع؛

Shawn Liang, Sahil Shah, Chengwei Zhou, SP Sharan, Harsh Goel, Arnab Sanyal, Sandeep Chinchali, Gourav Datta2026-03-02
🤖 AI

Evidential Neural Radiance Fields

تقدم هذه الورقة البحثية "حقول الإشعاع العصبي الدليلية" (Evidential Neural Radiance Fields)، وهو إطار عمل احتمالي يتيح التحديد الكمي المتزامن لكل من عدم اليقين العشوائي (aleatoric) وعدم اليقين المعرفي (epistemic) في نمذجة المشاهد ثلاثية الأبعاد من خلال تمريرة أمامية واحدة دون المساس بجودة التصوير أو تكبد أعباء حسابية كبيرة.

Ruxiao Duan, Alex Wong2026-03-02
💻 computer science

Extended Reality (XR): The Next Frontier in Education

يتناول هذا المقال كيف تُحدث تقنية الواقع الممتد (XR) تحولاً في التعليم من خلال التعلم الغامر، مع معالجة العوائق الكبيرة المتمثلة في التكلفة، والتعقيد التقني، والمخاوف الأخلاقية المتعلقة بالبيانات التي يجب التغلب عليها لتحقيق التوازن بين الابتكار وسهولة الوصول والأمن.

Shadeeb Hossain2026-03-02
🤖 AI

DLEBench: Evaluating Small-scale Object Editing Ability for Instruction-based Image Editing Model

تقدم هذه الورقة البحثية DLEBench، وهو أول معيار مصمم لتقييم نماذج تحرير الصور القائمة على التعليمات من خلال تحرير الكائنات على نطاق صغير عبر مجموعة بيانات تحديّة تضم 1,889 عينة وبروتوكول تقييم ثنائي الوضع مُحسّن، مما يكشف عن فجوات كبيرة في الأداء بين النماذج الحالية.

Shibo Hong, Boxian Ai, Jun Kuang, Wei Wang, FengJiao Chen, Zhongyuan Peng, Chenhao Huang, Yixin Cao2026-03-02
💻 computer science

Suppressing Prior-Comparison Hallucinations in Radiology Report Generation via Semantically Decoupled Latent Steering

تقدم هذه الورقة البحثية "التوجيه الكامن المنفصل دلاليًا" (SDLS)، وهو إطار عمل للتدخل أثناء الاستنتاج لا يتطلب تدريبًا، يستخدم التفكيك الدلالي المدفوع بالنماذج اللغوية الكبيرة والتعامد القائم على تحليل (QR) لتوليد ناقلات تدخل تعمل تحديدًا على كبح الهلوسة الناتجة عن المقارنة السابقة في توليد تقارير الأشعة مع الحفاظ على الدقة السريرية.

Ao Li, Rui Liu, Mingjie Li, Sheng Liu, Lei Wang, Xiaodan Liang, Lina Yao, Xiaojun Chang, Lei Xing2026-03-02
🤖 machine learning

Any Model, Any Place, Any Time: Get Remote Sensing Foundation Model Embeddings On Demand

لمعالجة تحديات عدم التجانس في نماذج التأسيس الخاصة بالاستشعار عن بُعد، تقدم هذه الورقة rs-embed، وهي مكتبة بلغة بايثون تتيح للمستخدمين استرداد التضمينات من أي نموذج مدعوم لأي موقع ونطاق زمني من خلال واجهة موحدة ذات سطر واحد.

Dingqi Ye, Daniel Kiv, Wei Hu, Jimeng Shi, Shaowen Wang2026-03-02
💻 computer science

A Difference-in-Difference Approach to Detecting AI-Generated Images

تقترح هذه الورقة طريقة جديدة للفرق في الفروق (difference-in-difference) تعمل على تحسين كشف الصور المولدة بواسطة الذكاء الاصطناعي من خلال استخدام الفروق من الدرجة الثانية في خطأ إعادة البناء لتحقيق تعميم ودقة متفوقين مقارنة بالنهج الحالي القائم على الدرجة الأولى.

Xinyi Qi, Kai Ye, Chengchun Shi, Ying Yang, Hongyi Zhou, Jin Zhu2026-03-02
💻 computer science

U-Mind: A Unified Framework for Real-Time Multimodal Interaction with Audiovisual Generation

يُعد U-Mind إطاراً موحداً رائداً يُمكّن من التفاعل متعدد الوسائط عالي الذكاء في الوقت الفعلي، وذلك عبر النمذجة المشتركة للغة، والكلام، والحركة، وتوليد الفيديو من خلال استراتيجية محاذاة واستدلال مبتكرة لتحقيق وكلاء محادثة متماسكين ومتزامنين ومعبرين.

Xiang Deng, Feng Gao, Yong Zhang, Youxin Pang, Xu Xiaoming, Zhuoliang Kang, Xiaoming Wei, Yebin Liu2026-03-02