💻 computer science

AMPLIFAI: A Multiphase CT Dataset for Benchmarking Clinical Reasoning in LI-RADS Assessment of Liver Lesions

تقدم هذه الورقة البحثية AMPLIFAI، وهي أول مجموعة بيانات متاحة للجمهور من فحوصات الأشعة المقطعية البطنية متعددة الأطوار والموسومة بفئات LI-RADS والمجزأة للميزات الرئيسية، والتي صُممت للتغلب على ندرة البيانات ودفع عجلة التشخيص القائم على الذكاء الاصط الاصطناعي لسرطان الخلايا الكبدية دون الحاجة لخزعة.

Pranav Kulkarni, Nikhil Shah, Amritansh Suryavanshi, Jana Delfino, James Tonascia, Jade Wong-You-Cheong, Barton Lane, Jo (…)2026-08-18
💻 computer science

Zero-Shot Adaptation of Medical Vision Foundation Models for High-Frequency Micro-Ultrasound Prostate Segmentation

تقدم هذه الورقة مسار عمل بنظام "التعلم الصفري" (zero-shot) يجمع بين نموذج MedSAM التأسيسي وتقنيات محددة لمعالجة الصور اللاحقة لتحقيق دقة عالية في تقسيم البروستاتا في صور الموجات فوق الصوتية الدقيقة عالية التردد دون الحاجة إلى أي بيانات تدريبية، مما يتغلب على قيود الطرق الخاضعة للإشراف والتباين بين المراقبين.

Ayusha Abbas, Saram Abbas, Kabita Adhikari2026-08-18
🤖 AI

Do LLMs Know What to Ask and When? Evaluating Multi-Turn Information Seeking

تقدم هذه الورقة MT-InfoSeek، وهي مجموعة تقييم مضبوطة تُظهر أنه بينما تستطيع النماذج اللغوية الكبيرة إدراك الحاجة إلى معلومات إضافية في المهام متعددة الأدوار غير محددة المواصفات، إلا أنها تقلل بشكل منهجي من مقدار المعلومات المطلوبة، وتفشل في تحديد الاستعلامات الدنيا الكافية، وتواجه صعوبة في ترتيب الاستعلامات، مما يكشف عن فجوة متميزة بين قدراتها في البحث عن المعلومات ومقاييس التقييم الحالية.

Yepeng Huang, Jiawen Zhang, Michelle Dai, Xiaorui Su, Shanghua Gao, Zi Wang, Marinka Zitnik2026-08-18
💻 computer science

What Makes a Good Layer? Assessing the Layer-Wise Intrinsic Properties of Music Foundation Models

تحلل هذه الورقة بشكل منهجي الخصائص الهندسية والتحويلية الجوهرية لـ 12 نموذجاً أساسياً للموسيقى عبر 15 مهمة تابعة لتحديد معايير فعالة لاختيار الطبقات، كاشفةً أنه في حين تتنبأ المقاييس القياسية بالأداء للعديد من المهام، فإن مقياساً جديداً لثبات التناظر عند تغيير طبقة الصوت (pitch-transposition equivariance) مطلوب لتقييم المهام النغمية بدقة، مما يثبت في النهاية أن هذه المقاييس الجوهرية يمكن أن تتفوق على طرق دمج الطبقات القابلة للتدريب في عملية اختيار الطبقات.

Angelos-Nikolaos Kanatas, Yuexuan Kong, Pablo Alonso-Jiménez, Xavier Serra, Dmitry Bogdanov2026-08-18
🤖 AI

Discovering High-Quality Chess Puzzles with Offline Reinforcement Learning

تقدم هذه الورقة البحثية نهجاً للتعلم التعزيزي غير المتصل الذي يستفيد من 1.5 مليار سجل تاريخي لحل الألغاز من قبل المستخدمين لتوليد واختيار ألغاز شطرنج عالية الجودة وفعالة تربوياً بشكل تلقائي، مما يظهر تحسينات ملحوظة في نمو التعلم للاعبين المبتدئين الذين يعانون من ركود في التقدم.

Allen Nie, Anirudhan Badrinath, Nicholas Tomlin, Timothy Dai, Carissa Yip, Rose E Wang, Emma Brunskill, Chris Piech2026-08-18
📊 statistics

ARISE: An adaptive residual-informed stability ensemble for feature selection in small-sample biomedical omics

تقدم الورقة البحثية ARISE، وهو إطار عمل تجميعي تكيفي لاختيار الميزات في البيانات الحيوية الأومية ذات العينات الصغيرة، والذي يدمج التحكم في الصلة والاستقرار والازدواجية ليتفوق باستمرار على الأساليب الحالية عبر مجموعات البيانات والمصنفات ومقاييس التقييم المتنوعة.

Zardad Khan, Amjad Ali, Naz Gul, Sheema Gul, Saeed Aldahmani2026-08-18
🔬 materials science

When do machine-learned exchange-correlation improvements inherit into density-functional tight binding?

توضح هذه الورقة أن التحسينات الناتجة عن دالات التبادل والارتباط المتعلمة آلياً لا تنتقل تلقائياً إلى نظرية الربط القوي لكثافة المدارات بسبب وجود تعارضات جوهرية بين المؤثرات المعتمدة على المدارات والجهود الضربيه، مما يؤدي غالباً إلى "نقل عكسي" حيث تسوء فجوات النطاق، مع تحديد مكونات هيكلية محددة مثل كتل الموقع الواحد وقشور الاستقطاب التي يجب تحسينها لتحقيق بارامترية ناجحة.

Can Polat, Mustafa Kurban, Erchin Serpedin, Hasan Kurban2026-08-18
🤖 machine learning

Workspace Topology as an Attack Vector in Agentic Coding Assistants

تثبت هذه الورقة تجريبياً أن "طوبولوجيا مساحة العمل" لبيئة المطور — والتي تشمل عوامل مثل عمق المجلدات، ونمطية الكود المصدري، وتأطير السياق — تؤثر بشكل كبير على معدل نجاح هجمات حقن الأوامر غير المباشرة ضد مساعدي البرمجة الوكيلين، حيث تعمل الهياكل عالية النمطية والإشارات الأمنية على تقليل الضعف بشكل ملحوظ.

Alexandre G. R. Day, Pradeep Yadlapalli, Sriram Venkatapathy, Thomas Paniagua, Nick Raines, Sahil Wadhwa, Himanshu Kumar (…)2026-08-18
🤖 machine learning

Interpretable Cross-Lingual Alignment in Small Language Models: Probing Cultural and Pragmatic Reasoning in Japanese-English Bilingual LLMs

تقدم هذه الورقة البحثية J-PragEval-v0، وهو معيار للأزواج الدنيا للظواهر البراغماتية في اللغة اليابانية، وتستخدم سبر الخطوط المستقيمة وتوجيه التنشيط على نموذج ثنائي اللغة بحجم 1.5 مليار معلمة لتوضيح أنه بينما يمكن فك تشفير صيغ التبجيل خطياً في التدفقات المتبقية، فإن التباينات البراغماتية الأخرى مثل الموضوعات الضمنية والإشارات داخل المجموعة يتم حلها أثناء التوليد بدلاً من تخزينها عند المطالبة.

Florian Braun2026-08-18
📊 statistics

Optimal Watermark Localization in Mixed-Source Large Language Model Texts

تصيغ هذه الورقة البحثية تحديد موقع العلامة المائية في نصوص النماذج اللغوية الكبيرة ذات المصادر المختلطة كمسألة اختبار متعدد على مستوى الرمز (token)، مع وضع انتقالات طورية نظرية للكشف والتصنيف، واقتراح طريقة عتبة تكيفية تحقق قوة اكتشاف مثلى دون الحاجة إلى معرفة مسبقة بمدى تشتت الإشارة أو معاملات التوزيع.

Jose H. Blanchet, T. Tony Cai, Xiang Li, Hao Liu, Qi Long, Weijie J. Su2026-08-18