🤖 machine learning

Polymorphism Is Rotation: Operational Mechanistic Interpretability from a Two-Layer Transformer to Pythia-70m

تُثبت هذه الورقة أن نماذج المحولات (transformers) المدربة بشكل مستقل تحسب دوالاً متطابقة باستخدام إحداثيات داخلية غير مفهومة متبادلاً ومرتبطة بدوران عشوائي منتظم، وهي ظاهرة تُسمى "تعدد الأشكال" (polymorphism) يمكن حلها عبر عملية مطابقة "بروكرستس" متعامدة واحدة لتمكين النقل المباشر لقواميس الميزات ومتجهات التوجيه دون الحاجة لإعادة التدريب.

Jordan F. McCann2026-05-26
🤖 machine learning

LAPLEX: The FFT of Learnable Laplace Kernels

يقدم LAPLEX فئة من مؤثرات نواة لابلاتس (Laplace-kernel) الدقيقة والقابلة للتدريب، والتي تحقق مقياساً يشبه تحويل فوريه السريع (FFT-like scaling) لتمكين التفاعلات العالمية المتكيفة مع البيانات ونمذجة التباين عالي الأبعاد دون تكاليف تخزين المصفوفات الكثيفة، مما يفصل بفعالية بين القدرة التعبيرية ومتطلبات الذاكرة.

Łukasz Struski, Hanna Blazhko, Piotr Kubaty, Jacek Tabor2026-05-26
🤖 AI

Hera: Learning Long-Horizon Coordination for Device-Cloud Collaborative LLM Agents

تُعد Hera منسقاً مبتكراً على مستوى الخطوات للتنسيق بين الأجهزة والسحابة للوكلاء ذوي النماذج اللغوية الكبيرة (LLM) طويلي الأمد، حيث تعتمد نموذج تدريب ثنائي المرحلة يتكون من التعلم بالتقليد والتعلم المعزز المدرك للتكلفة لتحسين التوازن بين نجاح المهمة والتكلفة الحسابية، محققةً أداءً يقارب أداء السحابة فقط مع تقليل استخدام السحابة بشكل كبير.

Yuxin Zhang, Mengxue Hu, Zheng Lin, Xiaoyi Fan, Fan Xie, Zihan Fang, Jing Yang, Wenjun Zhu, Zhiwen Chen, Chengfei Lv, Zh (…)2026-05-26
💻 computer science

Correcting Visual Blur Induced by Attention Distraction to Reduce Hallucinations: Algorithm and Theory

تقترح هذه الورقة طريقة AFIP، التي تخفف من هلاوس الكائنات في النماذج اللغوية الكبيرة متعددة الوسائط من خلال ربطها نظرياً بتشتت الانتباه ومعالجة هذه المشكلة عبر إثراء الانتباه عبر الرؤوس وتعزيز الانتباه التاريخي الديناميكي دون الحاجة إلى تدريب إضافي.

Quanjiang Li, Zhiming Liu, Wei Luo, Tingjin Luo, Chenping Hou2026-05-26
🤖 AI

Lattice theory and algebraic models for deep convolutional learning based on mathematical morphology

تؤسس هذه الورقة إطاراً جبرياً صارماً قائماً على نظرية الشبكة (lattice theory) والمورفولوجيا الرياضية لتحليل الشبكات العصبية الالتفافية العميقة، كاشفةً أن طبقات الشبكات الالتفافية التقليدية تشكل مؤثرات شبكية متقاطعة غير متماثلة (non-idempotent cross-lattice operators) تفسر القدرة التمثيلية للعمق، مع اقتراح وتوصيف ثلاثة تصميمات لطبقات مورفولوجية متماثلة (idempotent) حقيقية وتوحيد مختلف تقنيات التجميع (pooling) والهرم (pyramid) تحت نظرية مرافق (adjoint theory) موحدة.

Gustavo (Jesus), Angulo2026-05-26
💻 computer science

Phase-Aware Wavelet-Based-Scattering Encoder-Decoder for Dense Predictions

تقترح هذه الورقة مشفرًا-فك مشفر للتشتت مدركًا للطور (Phase-Aware Scattering Encoder-Decoder) يعمل على تعزيز مهام التنبؤ الكثيف مثل إزالة الضجيج من الصور وتجزئة آفات الجلد، وذلك من خلال الحفاظ صراحةً على معلومات الطور في وصلات التخطي، مما يؤدي إلى استعادة البنية المكانية المفقودة في تحويلات التشتت التقليدية وتحسين مقاييس الأداء بشكل كبير.

Ghassen Marrakchi, Basarab Matei2026-05-26
🤖 machine learning

Beyond Generative Priors: Minority Sampling with JEPA-Guided Diffusion

تقدم هذه الورقة "توجيه JEPA"، وهو إطار عمل لأخذ عينات الانتشار يستفيد من نماذج العالم ذات بنية التنبؤ بالتمثيل المشترك (JEPA) لتحديد وتوليد عينات الأقلية بناءً على الندرة الدلالية في العالم الحقيقي بدلاً من الكثافات الخاصة بالنموذج، مما يحسن دقة وصلاحية الحالات منخفضة الكثافة المولدة عبر مختلف مهام التوليد.

Sol Park, Soobin Um2026-05-26
💻 computer science

Demystifying the Mythos or Disrupting Bugonomics? From Zero-Day Asymmetry to Defender Remediation Throughput

تجادل هذه الورقة بأن التأثير الرئيسي للنماذج اللغوية الكبيرة على الأمن السيبراني لا يقتصر مجرد زيادة في اكتشافات الثغرات الصفرية، بل يتمثل في تحول جوهري في "اقتصاديات الثغرات" (bugonomics) حيث ينتقل عنق الزجاجة من إيجاد الثغرات إلى قدرة المدافع على التحقق من التقارير الناتجة وتصنيفها ومعالجتها، والتي ستشهد طفرة في الحجم وانخفاضاً في التكلفة.

Alfredo Pesoli, Herman Errico, Lorenzo Cavallaro2026-05-26
🤖 AI

GlobalDentBench: A Multinational Benchmark for Evaluating LLM Clinical Reasoning in Dentistry with Expert Calibration

تقدم هذه الورقة GlobalDentBench، وهو أول معيار مرجعي لطب الأسنان متعدد الجنسيات يضم 8,978 سؤالاً تم التحقق من صحتها من قبل خبراء عبر 14 تخصصاً وثلاثة مستويات من الاستنتاج، والذي يكشف أن النماذج اللغوية الكبيرة الحالية تظهر تدهوراً كبيراً في الأداء في الاستنتاج السريري المعقد وتشكل مخاطر سلامة جسيمة، بما في ذلك معدل 31.01% من التوصيات غير الآمنة.

Junjie Zhao, Jingyi Liang, Zhenyang Cai, Jiaming Zhang, Zhenwei Wen, Shuzhi Deng, Wenjing Yi, Chunfeng Luo, Hexian Zhang (…)2026-05-26
🤖 machine learning

On the Stability and Realizability of Recurrent Polynomial Surrogate Ternary Logic Gate Networks

تقدم هذه الورقة شبكة البوابات المنطقية الثلاثية المتكررة والقابلة للتفاضل (R-DTLGN)، وهي بنية مبتكرة تتعلم التنبؤ بأحكام المنطق الزمني الإشاري مع توفير ضمانات رسمية للديناميكيات المستقرة والامتناع المبدئي تحت ظروف تدهور المستشعرات من خلال العمل عبر منطق كليين ثلاثي القيم واستخلاص حجم الشبكة مباشرة من بنية الصيغة الزمنية.

Sai Sandeep Damera, Ryan Matheu, Aniruddh G. Puranic, John S. Baras, Calin Belta2026-05-26