🤖 machine learning

Semi-supervised learning with max-margin graph cuts

تقدم هذه الورقة خوارزمية جديدة للتعلم شبه المُشرف تعظم الهامش لقطع الرسوم البيانية بالنسبة لتسميات الدوال التوافقية، مما يظهر أداءً فائقاً على طرق تنظيم المتعددات ذات الأبعاد (manifold regularization) الرائدة في كل من مجموعات البيانات الاصطناعية والواقعية.

Branislav Kveton, Michal Valko, Ali Rahimi, Ling Huang2026-04-30
⚛️ quantum physics

Quantum Feature Selection with Higher-Order Binary Optimization on Trapped-Ion Hardware

تقدم هذه الورقة إطار عمل لاختيار الميزات الكمومية باستخدام صيغة التحسين الثنائي غير المقيد من الرتبة العليا (HUBO) مع التبعيات متعددة المتغيرات، والتي تم تنفيذها بنجاح على أجهزة الأيونات المحاصرة من نوع IonQ Forte لإثبات أداء تصنيف تنافسي وجدوى التحسين الكمومي من الرتبة العليا لمعالجة البيانات مسبقاً في تعلم الآلة.

Carlos Flores-Garrigós, Anton Simen, Qi Zhang, Enrique Solano, Narendra N. Hegade, Sayonee Ray, Claudio Girotto, Jason I (…)2026-04-30
🤖 machine learning

Unifying Sparse Attention with Hierarchical Memory for Scalable Long-Context LLM Serving

تقدم الورقة البحثية SPIN، وهو إطار عمل استدلال مصمم بشكل مشترك يوحد خوارزميات الانتباه المتناثرة المتنوعة مع إدارة هرمية لذاكرة وحدة معالجة الرسومات ووحدة المعالجة المركزية من خلال تجريد مشترك قائم على الصفحات، وتخزين مؤقت مدرك للمحلية، وتخطيطات بيانات وصفية محسنة، محققاً تحسينات كبيرة في معدل الإنتاجية وزمن الاستجابة مقارنة بتطبيقات vLLM والانتباه المتناثر الحالية.

Zihan Zhao, Baotong Lu, Shengjie Lin, Yizou Chen, Jing Liu, Yanqi Zhang, Ziming Miao, Ming-Chang Yang, Haiying Shen, Qi (…)2026-04-30
🤖 machine learning

Language Diffusion Models are Associative Memories Capable of Retrieving Unseen Data

تُثبت هذه الورقة أن نماذج الانتشار المنفصلة القائمة على التوزيع الموحد تعمل كذاكرات ترابطية قادرة على استرجاع بيانات غير مرئية، حيث يتم التحكم في الانتقال من الحفظ إلى التعميم عبر حجم مجموعة التدريب، ويمكن اكتشاف ذلك عملياً من خلال الإنتروبيا الشرطية لتسلسلات الرموز المتوقعة.

Bao Pham, Mohammed J. Zaki, Luca Ambrogioni, Dmitry Krotov, Matteo Negri2026-04-30
💬 NLP

MoRFI: Monotonic Sparse Autoencoder Feature Identification

تقدم هذه الورقة البحثية MoRFI، وهي طريقة تستخدم المشفرات التلقائية المتناثرة (sparse autoencoders) لتحديد الاتجاهات الكامنة في النماذج اللغوية الكبيرة التي ترتبط ارتباطاً طردياً مع الهلوسة أثناء الضبط الدقيق على معرفة جديدة، مما يثبت أن هذه الميزات المحددة يمكن التدخل فيها لاستعادة قدرة النموذج على استرجاع المعرفة المخزنة.

Dimitris Dimakopoulos, Shay B. Cohen, Ioannis Konstas2026-04-30
🤖 machine learning

KAYRA: A Microservice Architecture for AI-Assisted Karyotyping with Cloud and On-Premise Deployment

تقدم هذه الورقة KAYRA، وهي بنية خدمات مصغرة قائمة على الحاويات لنمط نووي مدعوم بالذكاء الاصطناي، تجمع بين خط معالجة تعلم عميق متتالي ونشر مرن عبر السحابة أو في الموقع، مما أظهر تحسينات ذات دلالة إحصائية في دقة التجزئة والتصنيف مقارنة بالأنظمة التجارية القائمة في تقييم سريري تجريبي.

Attila Pintér, Javier Rico, Attila Répai, Jalal Al-Afandi, Adrienn Éva Borsy, András Kozma, Hajnalka Andrikovics, György (…)2026-04-30
💬 NLP

HealthNLP_Retrievers at ArchEHR-QA 2026: Cascaded LLM Pipeline for Grounded Clinical Question Answering

حقق فريق HealthNLP_Retrievers نتائج تنافسية في مهمة ArchEHR-QA 2026 المشتركة عبر توظيف مسار متتالي مدعوم بنموذج Gemini 2.5 Pro يدمج بين إعادة صياغة الاستعلام، وتصنيف الأدلة، وتوليد استجابات مستندة إلى أدلة، والمواءمة لتقديم إجابات دقيقة ومبنية على الأدلة لأسئلة المرضى المستمدة من السجلات الصحية الإلكترونية.

Md Biplob Hosen, Md Alomgeer Hussein, Md Akmol Masud, Omar Faruque, Tera L Reynolds, Lujie Karen Chen2026-04-30
📊 statistics

Stochastic Scaling Limits and Synchronization by Noise in Deep Transformer Models

تثبت هذه الورقة أن التطور الطبقي للرموز (tokens) في نماذج المحولات ذات العمق والعرض المحددين والتي تحتوي على كتل (MLP)، يتقارب نحو نظام جسيمات متفاعلة عشوائي في زمن مستمر، مما يثبت انتشار الفوضى ويُظهر أن الضجيج المشترك شديد التماسك كافٍ لإحداث التزامن عبر الضجيج وتبديد الطاقة الأسي في النموذج الحدّي.

Andrea Agazzi, Giuseppe Bruno, Eloy Mosig García, Samuele Saviozzi, Marco Romito2026-04-30
💬 NLP

Turning the TIDE: Cross-Architecture Distillation for Diffusion Large Language Models

تقدم الورقة البحثية TIDE، وهو أول إطار عمل للتقطير عبر البنيات لنماذج الانتشار اللغوية الكبيرة، والذي يستخدم ثلاثة مكونات مبتكرة لنقل المعرفة بنجاح من نماذج معلمة غير متجانسة بحجم 8 مليار و16 مليار معلمة إلى نموذج طالب بحجم 0.6 مليار، متفوقاً بشكل ملحوظ على النماذج المرجعية ذات التوليد الذاتي في اختبارات معيارية مثل توليد الكود.

Gongbo Zhang, Wen Wang, Ye Tian, Li Yuan2026-04-30
🤖 machine learning

A Review of the Receiver Operating Characteristic Curve and a Proof About the Area Beneath It

تُصيغ هذه الورقة التفسير الاحتمالي للمساحة تحت منحنى خصائص تشغيل المستقبِل (AUC) باعتبارها احتمالية قيام المصنف بترتيب حالة إيجابية عشوائية في مرتبة أعلى من حالة سلبية عشوائية، وتوفر حداً للخطأ عندما لا تتحقق الفرضيات الأساسية، وتقدم مراجعة أدبية موجزة لمنحنيات خصائص تشغيل المستقبِل.

Steven Redolfi2026-04-30✓ Author reviewed ⓘ