🤖 AI

SCOUT: Unlocking Enhanced Spatial Reasoning via Structured Chain-of-Thought and Multi-Objective Process Reward

تقترح الورقة البحثية إطار عمل SCOUT، الذي يجمع بين نهج سلسلة أفكار ثلاثي الأبعاد مهيكل وخوارزمية تعزيز مكافأة عملياتية جديدة متعددة الأهداف ومجموعة بيانات مخصصة لتعزيز قدرات الاستدلال المكاني لنماذج الرؤية واللغة بشكل كبير، محققةً أداءً يتجاوز GPT-4o في المهام المعقدة.

Zile Zhou, Huining Yuan, Weichen Zhang, Xinlei Chen, Xiao-ping Zhang2026-08-13
⚡ electrical engineering

Domain-Aware Lightweight Spectral-Grouped Convolutions for Hyperspectral Fish Freshness Classification

تقترح الورقة البحثية نموذج SGNet، وهو بنية تعلم عميق خفيفة الوزن ومعرفة بالمجال، تستخدم عمليات تلافيفية ذات مجموعات طيفية وآليات انتباه مزدوجة لتحقيق تصنيف عالي الدقة وفي الوقت الفعلي لطزاجة الأسماك من الصور فائقة الطيف بمعاملات أقل بكثير من النماذج التقليدية.

Kazi Nabiul Alam, Pooneh Bagheri Zadeh, Akbar Sheikh-Akbari2026-08-13
⚡ electrical engineering

Few-Shot Ordinal Learning for Day-Wise Freshness Estimation with Hyperspectral Fish Images

تقدم هذه الورقة إطار عمل جديد للتعلم الرتبي بلقطات قليلة يستفيد من التصوير الفائق الطيفي والقيود القائمة على الأسس البيولوجية لتقدير طزاجة الأسماك يومياً بدقة باستخدام الحد الأدنى من البيانات المصنفة، متفوقاً بشكل كبير على الأساليب الخاضعة للإشراف الكامل الحالية في ظل بروتوكولات قطع الفيليه غير المرئية الصارمة.

Kazi Nabiul Alam, Pooneh Bagheri Zadeh, Akbar Sheikh-Akbari2026-08-13
🤖 AI

An Agentic Workflow for Legacy HPC Modernization: Converting the Two-Electron-Integral Core of GAMESS

تقدم هذه الورقة سير عمل وكيلِيًّا نجح في تحديث 56,448 سطرًا من كود فورتران 77 (Fortran 77) الموروث في حزمة "جاميس" (GAMESS) للكيمياء الكمومية إلى فورتران 2008 (Fortran 2008) عبر توظيف ثلاثة وكلاء ذكاء اصطناعي متخصصين في صياغة الأوامر تحت إشراف بشري وعبر أوراكل تحقق صارم (bit-for-bit verification oracle)، محققين بذلك تحققًا مثاليًا عبر 612 عملية اختبار.

Yuzhong Shen, Masha Sosonkina, Peng Xu, Mark S. Gordon2026-08-13
🤖 AI

Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams

تقدم هذه الورقة Diagram-MMU، وهو معيار متعدد الوسائط يضم 3.7 ألف رسم توضيحي علمي و18.3 ألف سؤال تم التحقق من صحتها لتقييم نماذج اللغات الكبيرة متعددة الوسائط (MLLMs) في مهام تحويل الرسم التوضيحي إلى كود، والتحرير، والإجابة على الأسئلة، مما يكشف عن تفوق النماذج في الاستنتاج، بينما تعاني في مهام توليد الكود ما لم تعمل في بيئات وكيلة (agentic settings).

Weihao Bo, Shan Zhang, Yanpeng Sun, Jie Liu, Yongke Yao, Jinhao Du, Wei He, Kai Zou, Zechao Li, Jingdong Wang2026-08-13
🤖 AI

A Neighborhood Attention Transformer Network for Enhanced 3D Segmentation of the Left Anterior Descending Artery

تقدم هذه الورقة البحثية إطار عمل NA-UNETR، وهو إطار تقسيم يعتمد على المحولات (transformer) يستخدم انتباه الجوار (Neighborhood Attention) والتحسين الموجه بعدم اليقين (uncertainty-guided optimization) لتحسين دقة تحديد الشريان الأمثل النازل (Left Anterior Descending artery) بشكل كبير في صور الأشعة المقطعية ثلاثية الأبعاد منخفضة التباين وذات التنفس الحر المستخدمة في تخطيط العلاج الإشعاعي للقلب.

Rafi Ibn Sultan, Chengyin Li, Yiannos Demetriou, Ahmed I. Ghanem, Joshua P. Kim, Justine Cunningham, Hassan Bagher-Ebadi (…)2026-08-13
💬 NLP

Structural Silence: When AI Infrastructure Fails Speakers of Underrepresented Languages

تجادل هذه الورقة بأن البنية التحتية للذكاء الاصطناًعي تضع المتحدثين باللغات غير الممثلة كفاية، مثل اللغة البنغالية، في وضع غير مواتٍ بشكل منهجي من خلال عوائق هيكلية — تشمل الندرة الشديدة في البيانات، وعدم كفاءة الترميز (tokenization)، وفجوات الاتصال — بدلاً من كونها مجرد قيود تقنية معزولة، مما يستوجب التحول نحو استراتيجيات تصميم تركز على العدالة وتعتمد مبدأ "الأولوية للعمل دون اتصال" (offline-first).

Avijit Roy, Proma Roy2026-08-13
🤖 AI

Beyond Trial-and-Error: Agentic Optimization for Image-to-Video Adherence

تقدم هذه الورقة إطار عمل "التحسين الذاتي الوكيل" (Agentic Self-Improvement)، وهو نظام تحسين مغلق الحلقة ذو مرحلتين يجمع بين صقل الأوامر المدفوع بنماذج اللغات الكبيرة متعددة الوسائط والتحسين البايزي لتعزيز موثوقية والزامية وجودة توليد الصور إلى فيديو في الأنظمة الصندوقية السوداء بشكل كبير، متفوقاً بذلك على طرق التجربة والخطأ التقليدية في دراسات التفضيل البشري.

Aman Tyagi, Hemanth Boinpally, Jonathan Chen, Douglas Gebert, Steven Hickson2026-08-13
🤖 AI

Constructing Dynamic Master Logic Models as Knowledge Graphs for Complex System Diagnostics Using Retrieval-Augmented Large Language Models

تقدم هذه الورقة إطار عمل يستفيد من تقنية التوليد المعزز بالاسترجاع والنماذج اللغوية الكبيرة لبناء نماذج المنطق الرئيسي الديناميكية القائمة على الرسوم البيانية والقابلة للتوسع تلقائياً من الوثائق التقنية، مما يتيح الاستنتاج التشخيصي المؤتمت وتحليل الموثوقية للأنظمة المعقدة مثل أنظمة سلامة المفاعلات النووية.

Saman Marandi, Yu-Shu Hu, Mohammad Modarres2026-08-13
🧬 biology

Emergent Neural Network Mechanisms for Generalization to Objects in Novel Orientations

تُثبت هذه الورقة أن الشبكات العصبية العميقة تعمم على الأجسام في اتجاهات ثنائية الأبعاد جديدة من خلال نشر عدم الحساسية للاتجاه من الأجسام المألوفة عبر عصبونات مضبوطة على سمات مشتركة، وهي آلية تتقوى مع المزيد من بيانات التدريب وتحاكي عمليات التعميم الشبيهة بالدماغ.

Avi Cooper, Xavier Boix, Daniel Harari, Spandan Madan, Hanspeter Pfister, Tomotake Sasaki, Pawan Sinha2026-08-12