💻 computer science

MedPlex: Deep Vision-Language Co-Adaptation for Clinically Grounded Medical Segmentation

يُعد MedPlex نموذجاً للرؤية واللغة متكاملاً يعمل على تحسين تجزئة الصور الطبية من خلال الدمج المستمر للمعرفة السريرية النصية مع الميزات البصرية عبر الاندماج ثنائي الاتجاه ومحاذاة المفاهيم متعددة المستويات، محققاً أداءً هو الأفضل في فئته عبر مختلف معايير التصوير المقطعي المحوسب والتصوير بالرنين المغناطيسي.

Rafi Ibn Sultan, Hui Zhu, Chengyin Li, Dongxiao Zhu2026-08-17
🤖 machine learning

SAGE: Surrogate-gradient Adaptation via Attention-Guided Entropy for Spiking Transformers

تقدم هذه الورقة SAGE، وهي آلية تدرج بديل معدلة بالارتياب للنماذج المحولة ذات الشبكات العصبية النبضية، والتي تعمل على تكييف ميل التدرج ديناميكيًا أثناء التدريب باستخدام اعتلاج الانتباه الذاتي لتحقيق تحسينات مستمرة في الدقة مقارنة بالنماذج المرجعية ذات البدائل الثابتة دون تغيير نموذج الاستدلال.

Kiran Nair, Rodrigue Rizk, KC Santosh2026-08-17
⚡ electrical engineering

TRUE-Colon: Exposing a Consistent Transfer Asymmetry in Real-Time Polyp Detection

تقدم الورقة البحثية بروتوكول TRUE-Colon، وهو بروتوكول قياس يوضح أن نماذج اكتشاف السلائل (اللحميات) في الوقت الفعلي التي تم تدريبها على مقاطع مختارة تركز على الآفات تعاني من انهيار حاد في الأداء في إعدادات الإجراءات الكاملة في العالم الحقيقي، بينما تحافظ النماذج المدربة على إجراءات كاملة على دقة عالية مع رفض المحتوى غير المتعلق بالسلائل بفعالية، مما يدعو إلى التحول نحو بيانات الإجراءات الكاملة ومقاييس ذات صلة بالنشر في تطوير أنظمة التشخيص بمساعدة الحاسوب (CADe).

Sebastian Doerrich, Andreas Franz Schwab, Francesco Di Salvo, Shyam Nandan Rai, Hanh Huyen My Nguyen, Christian Ledig2026-08-17
💻 computer science

Limitations of Synthetic Data Generation in Specialized Data-Scarce Domains

تُظهر هذه الورقة أنه على الرغم من الوعود التي تقدمها النماذج التوليدية القائمة على الانتشار، إلا أنها تفشل في التفوق باستمرار على النماذج المرجعية غير التوليدية القوية في المجالات المتخصصة وشحيحة البيانات مثل تصنيف الصدمات، وذلك بسبب مشكلات متكررة مثل الحفظ، والانزياح التوزيعي، وتوليد نماذج نمطية مفرطة في التبسيط.

Edward Zhang, Marcel Hussing, Tanay Tandon, Shenbagaraj Kannapiran, Jason Hughes, Youkang Wang, Joshua Caswell, Agelos K (…)2026-08-17
💻 computer science

CAST: Closed-form Analytic Semantic Transfer for Zero-Shot Classifier Extension

تقدم الورقة البحثية إطار عمل CAST، وهو إطار عمل لا يتطلب تدريباً ولا صوراً، يعمل على توسيع نطاق المصنفات سابقة التدريب لتشمل فئات غير مرئية عبر حقن الأوزان، مدعوماً بتحليل نظري للأخطاء، وقد أُثبت قدرته على مضاهاة أو تجاوز الأساليب الحالية للتعلم الصفري دون الحاجة إلى أمثلة من التوزيع المستهدف.

William Heyden, Habib Ullah, Muhammad Salman Siddiqui, Fadi Al Machot2026-08-17
🔬 physics

An Interactive, Automated 4D-STEM data acquisition and analysis routine for Scanning Electron Nanobeam Diffraction and Ptychography experiments

تقدم هذه الورقة سير عمل مؤتمتًا ومدفوعًا آليًا لجمع وتحليل بيانات 4D-STEM يتيح توصيفًا عالي الإنتاجية وذا دلالة إحصائية لمجموعات جسيمات البلاتين النانوية، مما يكشف عن معلومات تفصيلية حول التوجه، والمورفولوجيا، والطور، وإجهاد الشبكة البلورية على المقياس الذري.

Mohsen Danaie, Max England, Yiming Xu, Ruomu Zhang, Ed Darnbrough, Josh Willem De Boer, Frederick Allars, Zaeem Najeeb (…)2026-08-17
💬 NLP

Amplified Does Not Mean Predictive: Reasoning Behaviors in Thinking Models

تكشف هذه الورقة عن "فجوة تضخيم-رفع" (Amplification-Lift Gap) جوهرية في نماذج الاستدلال، حيث يعمل التدريب على تضخيم السلوكيات التأملية مثل التصحيح الذاتي والإقرار بعدم اليقين، وهي سلوكيات لا تتنبأ بالضرورة بالصحة، بينما يفشل في تعزيز السلوكيات عالية القيمة بشكل كافٍ مثل معايرة الثقة ومواءمة المعرفة.

Jean de Dieu Nyandwi, Leena Mathur, Yonatan Bisk, Robert Hawkins, Graham Neubig2026-08-17
💻 computer science

Doomed to Re-Annotate, Forever: The ImageNet Story

تقدم هذه الورقة ReImageNet، وهي نسخة معاد تعليقها بشكل شامل لمجموعة التحقق من ImageNet-1k تصحح ما يقرب من 12% من التسميات الأصلية وتدمج التسميات المتعددة، والتحديد الموضعي، والسمات الدلالية، مما يؤدي إلى مكاسب كبيرة في الدقة لكل من النماذج الخاضعة للإشراف ونماذج اللغات الكبيرة متعددة الوسائط (MLLMs) مع إثبات أن التوسيم واسع النطاق يتطلب تعاوناً تكرارياً بين البشر والنماذج اللغوية الكبيرة.

Illia Volkov, Nikita Kisel, Tetiana Mishkina, Klara Janouskova, Jiri Matas2026-08-17
💻 computer science

OpenBelief-Nav: Evidence-Preserving Object Memory for Open-Vocabulary Language-Guided Navigation

يقدم OpenBelief-Nav نظام ذاكرة كائنية يحافظ على الأدلة، يحتفظ بفرضيات متنوعة على مستوى الملاحظة ومصادرها لتمكين ملاحة مرنة وعالية الأداء ذات مفردات مفتوحة، متفوقاً بذلك على النماذج المرجعية ذات الالتزام المبكر في كل من دقة الخرائط الدلالية ومعدلات نجاح المهام عبر مجموعات بيانات متعددة وتجارب روبوتية في العالم الحقيقي.

Dinh Tuan Nguyen, Anh Dao, Phuong Nam Dang, Quan-Dung Pham, Tuyen P. Le, Truong Nguyen, Quan Nguyen2026-08-17
💻 computer science

ProFocus: Interpreting Affective Experience in Artistic Images with Progressive Visual Focusing

يُعد ProFocus إطار عمل مبتكر يعزز تفسير الاستجابات العاطفية في الصور الفنية من خلال توظيف "ناقد فني هرمي" لتوليد أولويات لغوية مهيكلة، ووحدة "دمج التلميحات التدريجي" لحقن هذه الإشارات تسلسلياً في الميزات البصرية، مما يحاكي الإدراك المعرفي البشري لتحقيق تمييز وتفسير عاطفي متفوق مقارنة بالأساليب الحالية.

Zhiyan Zhang, Zicheng Yan, Jianqi Chen, Peipei Song, Shanshan Wang, Xun Yang2026-08-17