🤖 machine learning

Language Diffusion Models are Associative Memories Capable of Retrieving Unseen Data

تُثبت هذه الورقة أن نماذج الانتشار المنفصلة القائمة على التوزيع الموحد تعمل كذاكرات ترابطية قادرة على استرجاع بيانات غير مرئية، حيث يتم التحكم في الانتقال من الحفظ إلى التعميم عبر حجم مجموعة التدريب، ويمكن اكتشاف ذلك عملياً من خلال الإنتروبيا الشرطية لتسلسلات الرموز المتوقعة.

Bao Pham, Mohammed J. Zaki, Luca Ambrogioni, Dmitry Krotov, Matteo Negri2026-04-30
💬 NLP

MoRFI: Monotonic Sparse Autoencoder Feature Identification

تقدم هذه الورقة البحثية MoRFI، وهي طريقة تستخدم المشفرات التلقائية المتناثرة (sparse autoencoders) لتحديد الاتجاهات الكامنة في النماذج اللغوية الكبيرة التي ترتبط ارتباطاً طردياً مع الهلوسة أثناء الضبط الدقيق على معرفة جديدة، مما يثبت أن هذه الميزات المحددة يمكن التدخل فيها لاستعادة قدرة النموذج على استرجاع المعرفة المخزنة.

Dimitris Dimakopoulos, Shay B. Cohen, Ioannis Konstas2026-04-30
🤖 machine learning

KAYRA: A Microservice Architecture for AI-Assisted Karyotyping with Cloud and On-Premise Deployment

تقدم هذه الورقة KAYRA، وهي بنية خدمات مصغرة قائمة على الحاويات لنمط نووي مدعوم بالذكاء الاصطناي، تجمع بين خط معالجة تعلم عميق متتالي ونشر مرن عبر السحابة أو في الموقع، مما أظهر تحسينات ذات دلالة إحصائية في دقة التجزئة والتصنيف مقارنة بالأنظمة التجارية القائمة في تقييم سريري تجريبي.

Attila Pintér, Javier Rico, Attila Répai, Jalal Al-Afandi, Adrienn Éva Borsy, András Kozma, Hajnalka Andrikovics, György (…)2026-04-30
💬 NLP

HealthNLP_Retrievers at ArchEHR-QA 2026: Cascaded LLM Pipeline for Grounded Clinical Question Answering

حقق فريق HealthNLP_Retrievers نتائج تنافسية في مهمة ArchEHR-QA 2026 المشتركة عبر توظيف مسار متتالي مدعوم بنموذج Gemini 2.5 Pro يدمج بين إعادة صياغة الاستعلام، وتصنيف الأدلة، وتوليد استجابات مستندة إلى أدلة، والمواءمة لتقديم إجابات دقيقة ومبنية على الأدلة لأسئلة المرضى المستمدة من السجلات الصحية الإلكترونية.

Md Biplob Hosen, Md Alomgeer Hussein, Md Akmol Masud, Omar Faruque, Tera L Reynolds, Lujie Karen Chen2026-04-30
📊 statistics

Stochastic Scaling Limits and Synchronization by Noise in Deep Transformer Models

تثبت هذه الورقة أن التطور الطبقي للرموز (tokens) في نماذج المحولات ذات العمق والعرض المحددين والتي تحتوي على كتل (MLP)، يتقارب نحو نظام جسيمات متفاعلة عشوائي في زمن مستمر، مما يثبت انتشار الفوضى ويُظهر أن الضجيج المشترك شديد التماسك كافٍ لإحداث التزامن عبر الضجيج وتبديد الطاقة الأسي في النموذج الحدّي.

Andrea Agazzi, Giuseppe Bruno, Eloy Mosig García, Samuele Saviozzi, Marco Romito2026-04-30
💬 NLP

Turning the TIDE: Cross-Architecture Distillation for Diffusion Large Language Models

تقدم الورقة البحثية TIDE، وهو أول إطار عمل للتقطير عبر البنيات لنماذج الانتشار اللغوية الكبيرة، والذي يستخدم ثلاثة مكونات مبتكرة لنقل المعرفة بنجاح من نماذج معلمة غير متجانسة بحجم 8 مليار و16 مليار معلمة إلى نموذج طالب بحجم 0.6 مليار، متفوقاً بشكل ملحوظ على النماذج المرجعية ذات التوليد الذاتي في اختبارات معيارية مثل توليد الكود.

Gongbo Zhang, Wen Wang, Ye Tian, Li Yuan2026-04-30
🤖 machine learning

A Review of the Receiver Operating Characteristic Curve and a Proof About the Area Beneath It

تُصيغ هذه الورقة التفسير الاحتمالي للمساحة تحت منحنى خصائص تشغيل المستقبِل (AUC) باعتبارها احتمالية قيام المصنف بترتيب حالة إيجابية عشوائية في مرتبة أعلى من حالة سلبية عشوائية، وتوفر حداً للخطأ عندما لا تتحقق الفرضيات الأساسية، وتقدم مراجعة أدبية موجزة لمنحنيات خصائص تشغيل المستقبِل.

Steven Redolfi2026-04-30✓ Author reviewed
🤖 AI

Survey on reinforcement learning for language processing

تقدم هذه المقالة نظرة عامة على أحدث أساليب التعلم التعزيزي لمعالجة اللغات الطبيعية مع تركيز أساسي على الأنظمة القائمة على الحوار من خلال تحديد المشكلات ذات الصلة، وتحليل مدى ملاءمة هذه النهج وحدودها، ورسم اتجاهات البحث المستقبلية الواعدة.

Victor Uc-Cetina, Nicolas Navarro-Guerrero, Anabel Martin-Gonzalez, Cornelius Weber, Stefan Wermter2026-04-29
📊 statistics

On quantitative Laplace-type convergence results for some exponential probability measures, with two applications

تضع هذه الورقة حدود تقارب من نوع لابلابلاس كمية لتدابير الاحتمال الأسية ذات الجهود الشبيهة بالمعيار تحت شرط جاكوبي معمّم باستخدام أدوات نظرية القياس الهندسي، وتطبق هذه النتائج على نماذج الاعتلاج الأقصى والتقارب عند درجات الحرارة المنخفضة لخوارزمية ديناميات لانجفان للتدرج العشوائي من أجل التقليل غير المحدب.

Valentin De Bortoli, Agnès Desolneux2026-04-29
🤖 machine learning

Quantifying the Effect of Feedback Frequency in Interactive Reinforcement Learning for Robotic Tasks

يتقصى هذا العمل تأثير تكرار التغذية الراجعة في التعلم التعزيزي التفاعلي للمهام الروبوتية ذات المساحات المستمرة، ويُظهر عدم وجود تردد أمثل واحد، وأن معدلات التغذية الراجعة يجب أن تُكيف ديناميكيًا مع الكفاءة المتزايدة للوكيل.

Daniel Harnack, Julie Pivin-Bachler, Nicolás Navarro-Guerrero2026-04-29