💻 computer science

Stride-Net: Fairness-Aware Disentangled Representation Learning for Chest X-Ray Diagnosis

تُعد "سترايد-نت" (Stride-Net) إطار عمل يراعي العدالة لتشخيص صور الأشعة السينية للصدر، حيث تستخدم قناعاً قابلاً للتعلم على مستوى الرقعة، وفقدان الارتباك التنافسي، والمحاذاة الدلالية عبر النقل الأمثل للمجموعات لتعلم تمثيلات مميزة للمرض وتكون غير متأثرة بالسمات الديموغرافية الحساسة.

Darakshan Rashid, Raza Imam, Dwarikanath Mahapatra, Brejesh Lall2026-02-12
💻 computer science

Chart Specification: Structural Representations for Incentivizing VLM Reasoning in Chart-to-Code Generation

تقترح هذه الورقة "توصيف المخطط" (Chart Specification)، وهو تمثيل وسيط مهيكل وآلية مكافأة مقابلة لـ "محاذاة التوصيف" (Spec-Align Reward) تعمل على تحسين دقة توليد الكود من المخططات عبر نقل تدريب النماذج اللغوية البصرية من محاكاة النصوص السطحية إلى الإشراف الهيكلي القائم على الدلالات.

Minggui He, Mingchen Dai, Jian Zhang, Yilun Liu, Shimin Tao, Pufan Zeng, Osamu Yoshie, Yuya Ieiri2026-02-12
💻 computer science

Towards Learning a Generalizable 3D Scene Representation from 2D Observations

تقدم هذه الورقة نهجاً لتمثيل الحقول الإشعاعية العصبية قابلاً للتعميم يتنبأ بإشغال مساحة العمل ثلاثية الأبعاد بالكامل في إطار إحداثيات عالمي من ملاحظات الروبوت ذاتية المركز، مما يتيح التلاعب الروبوتي الفعال دون الحاجة إلى ضبط دقيق خاص بالمشهد.

Martin Gromniak, Jan-Gerrit Habekost, Sebastian Kamp, Sven Magg, Stefan Wermter2026-02-12
🤖 AI

Healthy Harvests: A Comparative Look at Guava Disease Classification Using InceptionV3

تقارن هذه الدراسة بين أداء نموذجي التعلم العميق InceptionV3 وResNet50 في تصنيف أمراض الجوافة (الأنثراكنوز، ذبابة الفاكهة، والسليمة)، مما يظهر أن نموذج InceptionV3، المعزز بتقنيات زيادة البيانات والخلط، حقق دقة فائقة بلغت 98.15%.

Samanta Ghosh, Shaila Afroz Anika, Umma Habiba Ahmed, B. M. Shahria Alam, Mohammad Tahmid Noor, Nishat Tasnim Niloy2026-02-12
⚡ electrical engineering

Enhancing Predictability of Multi-Tenant DNN Inference for Autonomous Vehicles' Perception

لتعزيز إمكانية التنبؤ باستنتاج الشبكات العصبية العميقة متعددة المستأجرين في المركبات ذاتية القيادة، يقترح المؤلفون نظام PP-DNN، وهو نظام يختار ديناميكيًا الإطارات الحرجة ومناطق الاهتمام (ROIs) لتقليل متطلبات معالجة البيانات مع الحفاظ على الدقة وتحسين زمن انتقال الإدراك واكتماله بشكل كبير.

Liangkai Liu, Kang G. Shin, Jinkyu Lee, Chengmo Yang, Weisong Shi2026-02-12
💻 computer science

LaSSM: Efficient Semantic-Spatial Query Decoding via Local Aggregation and State Space Models for 3D Instance Segmentation

يُعد LaSSM إطار عمل فعال لتجزئة الكائنات ثلاثية الأبعاد يعالج مشكلات تهيئة الاستعلام والتكاليف الحسابية من خلال توظيف مُهيئ دلالي-مكاني هرمي وفك تشفير بنموذج حالة الفضاء (SSM) موجه بالإحداثيات، محققاً أداءً هو الأفضل في فئته على لوحة صدارة ScanNet++ V2 مع تقليل التكاليف الحسابية بشكل كبير.

Lei Yao, Yi Wang, Yawen Cui, Moyun Liu, Lap-Pui Chau2026-02-12
💻 computer science

FastFlow: Accelerating The Generative Flow Matching Models with Bandit Inference

يُعد FastFlow إطار عمل استدلال تكيُّفي جاهز للتشغيل، يعمل على تسريع نماذج مطابقة التدفق (flow-matching) باستخدام نهج "المتعدد الأذرع" (multi-armed bandit) لتخطي خطوات إزالة الضجيج بذكاء من خلال استقراء السرعة بالفروق المحدودة، مما يحقق تسريعاً كبيراً دون الحاجة لإعادة التدريب أو التضحية بالجودة.

Divya Jyoti Bajpai, Dhruv Bhardwaj, Soumya Roy, Tejas Duseja, Harsh Agarwal, Aashay Sandansing, Manjesh Kumar Hanawal2026-02-12
🤖 machine learning

From Circuits to Dynamics: Understanding and Stabilizing Failure in 3D Diffusion Transformers

تحدد هذه الورقة ظاهرة "Meltdown" (الانهيار) — وهي ظاهرة تتسبب فيها الاضطرابات الطفيفة في المدخلات في جعل محولات الانتشار ثلاثية الأبعاد تنتج مخرجات مجزأة — وتقترح تفسيراً ميكانيكياً يربط تنشيط انتباه تقاطعي محدد بـ "تفرع كسر التماثل" في ديناميكيات الانتشار، مقدمةً في النهاية "PowerRemap" لاستقرار عملية التوليد.

Maximilian Plattner, Fabian Paischer, Johannes Brandstetter, Arturs Berzins2026-02-12
💻 computer science

ZS-SRT: An Efficient Zero-Shot Super-Resolution Training Method for Neural Radiance Fields

إنّ ZS-SRT هو إطار عمل لزيادة الدقة الفائقة بنمط "التعلم الصفري" (zero-shot) يتكون من مرحلتين لحقول الإشعاع العصبي، يتيح توليد مناظر جديدة عالية الدقة من بيانات تدريب منخفضة الدقة من خلال التعلم الداخلي للمشهد الواحد والتركيب العكسي دون الحاجة إلى مجموعات بيانات خارجية عالية الدقة.

Xiang Feng, Yongbo He, Yubo Wang, Chengkai Wang, Zhenzhong Kuang, Jiajun Ding, Feiwei Qin, Jun Yu, Jianping Fan2026-02-11