💬 NLP

Leviathan: Decoupling Input and Output Representations in Language Models

تقدم الورقة البحثية "ليفياثان" (Leviathan)، وهي بنية "ترانسفورمر" (Transformer) تعمل على فصل تمثيلات المدخلات عن المخرجات من خلال استبدال مصفوفة التضمين المترابطة القياسية بترميز متجهي للتضمين المتعلم (LEV)، مما يحقق تحسينات ملحوظة في أداء نمذجة اللغة ومعايير الاختبار اللاحقة مع حد أدنى من الزيادة في عدد المعلمات.

Reza T. Batley, Sourav Saha2026-05-08
💬 NLP

Monotonic Reference-Free Refinement for Autoformalization

تقدم هذه الورقة إطار عمل للتحسين الرتيب التكراري غير المعتمد على مرجع للتحويل التلقائي للنظريات الكاملة، والذي يستفيد من التغذية الراجعة المتكاملة من مبرهنات النظريات وحكام النماذج اللغوية الكبيرة لتحسين الصلاحية الصورية، والحفاظ المنطقي، والاتساق الرياضي، والجودة الصورية في آن واحد، محققاً أداءً هو الأفضل في مجاله على معايير miniF2F وProofNet دون الحاجة إلى بيانات الحقيقة الأرضية أو تدخل بشري.

Lan Zhang, Marco Valentino, André Freitas2026-05-08
💬 NLP

CAMEL: Confidence-Gated Reflection for Reward Modeling

يُعد CAMEL إطار عمل للتأمل القائم على الثقة يجمع بين قرارات التفضيل الفعالة أحادية الرمز مع التصحيح الذاتي الانتقائي المدفوع بالتعلم التعزيزي للحالات منخفضة الثقة، مما يحقق دقة هي الأفضل في مجال نمذجة المكافأة مع عدد أقل بكثير من المعلمات ونسبة دقة إلى كفاءة متفوقة.

Zirui Zhu, Hailun Xu, Yang Luo, Yong Liu, Kanchan Sarkar, Kun Xu, Yang You2026-05-08
💬 NLP

PulseLM: A Foundation Dataset and Benchmark for PPG-Text Learning

تقدم هذه الورقة PulseLM، وهو عبارة عن مجموعة بيانات مرجعية ونموذج تأسيسي واسع النطاق يضم أكثر من مليون مقطع من إشارات PPG و2.5 مليون زوج من الأسئلة والأجوبة التي تجسر الفجوة بين الموجات الفسيولوجية الخام واللغة الطبيعية لتمكين التعلم متعدد الوسائط، والتعميم، والتقييم المعياري لنماذج الذكاء الاصطناعي القائمة على إشارات PPG.

Hung Manh Pham, Jinyang Wu, Xiao Ma, Yiming Zhang, Yixin Xu, Aaqib Saeed, Bin Zhu, Zhou Pan, Dong Ma2026-05-08
🤖 machine learning

Data-Driven Variational Basis Learning Beyond Neural Networks: A Non-Neural Framework for Adaptive Basis Discovery

تقدم هذه الورقة "تعلم الأساسات التبايني القائم على البيانات" (DVBL)، وهو إطار عمل غير عصبي يتعلم دوال أساس تفسيرية ومتكيفة مع البيانات من خلال التحسين التبايني، مما يوفر بديلاً شفافاً رياضياً للشبكات العصبية مع تقديم ضمانات صارمة بشأن الوجود والتقارب والقابلية لتحديد الهوية.

Andrew Kiruluta2026-05-08
💬 NLP

AdaGATE: Adaptive Gap-Aware Token-Efficient Evidence Assembly for Multi-Hop Retrieval-Augmented Generation

يُعد AdaGATE متحكماً في الأدلة، لا يتطلب تدريباً وكفؤاً في استهلاك الرموز (tokens)، لعمليات التوليد المعزز بالاسترجاع متعدد الخطوات، حيث يصيغ عملية اختيار الأدلة كمسألة إصلاح مدركة للفجوات، محققاً بذلك متانة وأداءً فائقين في ظروف الاسترجاع المشوبة بالضجيج أو التكرار مقارنة بالطرق الحالية.

Yilin Guo, Yinshan Wang, Yixuan Wang2026-05-08
💬 NLP

Beyond BLEU: A Semantic Evaluation Method for Code Translation

تقترح هذه الورقة منهجية تقييم دلالي مبتكرة لترجمة الكود البرمجي تستخدم اختبار المترجم (compiler testing) لقياس صحة التنفيذ، مما يثبت أن أدوات فك التجميع (decompilers) القائمة على النماذج اللغوية الكبيرة تتفوق بشكل كبير على النهج الاستدلالي، في حين تفشل المقاييس النحوية التقليدية مثل BLEU في الارتباط بالدقة الوظيفية.

Julius Näumann, Sven Keidel, Amir Molzam Sharifloo, Mira Mezini2026-05-08
💬 NLP

Counterargument for Critical Thinking as Judged by AI and Humans

تُظهر هذه الدراسة التدخلية أن الطلاب يوظفون التفكير النقدي بفعالية من خلال كتابة حجج مضادة للمحتوى المُنشأ بواسطة الذكاء الاصطناعي، وتؤكد أن النماذج اللغوية الكبيرة الرائدة، عندما يتم توجيهها بمعايير تقييم واضحة، يمكنها تقييم هذا العمل المكتوب بشكل موثوق وعلى نطاق واسع مع توافق متوسط مع التقييمات البشرية.

Tosin Adewumi, Marcus Liwicki, Foteini Simistira Liwicki, Lama Alkhaled, Hamam Mokayed, Esra Sümer-Arpak2026-05-08
💬 NLP

ZAYA1-8B Technical Report

تقدم الورقة البحثية نموذج ZAYA1-8B، وهو نموذج استدلال من نوع (MoE) بـ 8 مليارات معلمة يتميز بكفاءة عالية، تم تدريبه بالكامل على بنية تحتية من شركة AMD، ويحقق أداءً هو الأفضل في فئته على معايير الرياضيات والبرمجة من خلال تسلسل تعزيز تعلم رباعي المراحل وطريقة حساب وقت الاختبار (RSA) الماركوفية المبتكرة، مما يقلص الفجوة بفعالية مع النماذج الأكبر حجماً بكثير.

Robert Washbourne, Rishi Iyer, Tomas Figliolia, Henry Zheng, Ryan Lorig-Roach, Sungyeon Yang, Pritish Yuvraj, Quentin An (…)2026-05-08
💬 NLP

SLAM: Structural Linguistic Activation Marking for Language Models

تُعدُّ SLAM (الوسم بالنشاط اللغوي الهيكلي) مخطط وسم مائي جديد من النوع "الصندوق الأبيض" يحقق دقة كشف تقترب من المثالية مع حد أدنى من فقدان الجودة عبر توجيه الاتجاهات الهيكلية المحددة بواسطة المشفر التلقائي المتناثر في تيار البواقي، مما يحافظ على أخذ العينات المعجمية والدلالات مع تقديم ملف قوة متكامل مع طرق توزيع الرموز التقليدية.

Fabrice Harel-Canada, Amit Sahai2026-05-08