🤖 machine learning

TailedTS: Benchmark Dataset for Heavy-Tailed Time Series Prediction and Periodicity Quantification

تقدم هذه الورقة البحثية TailedTS، وهي مجموعة بيانات مرجعية واسعة النطاق لعدد مشاهدات صفحات ويكيبيديا التي تتميز بتوزيعات ذات ذيول ثقيلة وتضخم صفري، والمصممة لتقييم نماذج التنبؤ بالسلاسل الزمنية في ظل ظروف غير غاوسية والكشف عن رؤى حول دورية المنصات الرقمية ذات حركة المرور العالية.

Xinyu Chen, HanQin Cai, Lijun Ding, Jinhua Zhao2026-05-19
🤖 machine learning

When Is Rank-1 Steering Cheap? Geometry, Granularity, and Budgeted Search

تجادل هذه الورقة بأن التباين في فعالية توجيه التنشيط مدفوع أساساً بصعوبة البحث بدلاً من غياب الحلول من الرتبة الأولى، وتقترح إطار عمل GRACE الذي يستفيد من محاذاة حدود المطالبة ومقياس جديد لـ "حبيبية المفهوم" لتوجيه بحث ميزاني فعال وواعٍ بالهندسة للوصات التوجيهية المثلى.

John T. Robertson, Jianing Zhu, Haris Vikalo, Zhangyang Wang2026-05-19
🤖 machine learning

SwordBench: Evaluating Orthogonality of Steering Image Representations

تقدم هذه الورقة البحثية SwordBench، وهو معيار شامل لتقييم التعامد والفعالية في توجيه التمثيلات الصورية في نماذج الرؤية، كاشفةً أنه بينما توفر الطرق الخطية قدرة فائقة على الفصل، إلا أنها غالباً ما تفشل في منع الأضرار الجانبية مقارنة بالمشفرات التلقائية المتفرقة.

Vladimir Zaigrajew, Dawid Pludowski, Hubert Baniecki, Przemyslaw Biecek2026-05-19
🤖 machine learning

Cross-Source Supervision for Bone Infection Segmentation in Dual-Modality PET-CT

تقترح هذه الورقة إطار عمل للتعلم ثنائي المصدر ومنفصل يدمج نمطي التصوير المقطعي بالإصدار البوزيتروني (PET) والتصوير المقطعي المحوسب (CT) لمعالجة التباينات في التوصيف لتقسيم عدوى العظام، مستخدمةً تقييماً ثلاثي الأبعاد صارماً على مستوى المريض لإظهار كيف يمكن للنماذج المتوازية أن تستوعب بفعالية الفلسفات التشخيصية المتميزة للخبراء من أجل نشر ذكاء اصطناعي سريري قوي.

Zonglin Yang, Xiaolei Diao, Jishizhan Chen, Xiaozhuang Man, Wei Kong, Gen Wen, Pengfei Cheng, Daqian Shi2026-05-19
🤖 machine learning

CheckSupport: A Local LLM-Powered Tool for Automated Manuscript Submission Checklist Selection and Completion

تُعد CheckSupport أداة مفتوحة المصدر وقابلة للنشر محلياً، تستفيد من النماذج اللغوية الكبيرة المضبوطة بالتعليمات لأتمتة اختيار واستكمال قوائم مراجعة التقارير العلمية المستندة إلى الأدلة، مما يحقق دقة عالية وحفاظاً على الخصوصية مع تقليل العبء اليدوي لتقديم المخطوطات بشكل كبير.

Satvik Tripathi, Don Enwerem, Kevin Song, Kristian Quevada, Jacinta Arnold, Tessa S. Cook2026-05-19
🤖 machine learning

Mixing Times of Glauber Dynamics on Masked Language Models

تتقصى هذه الورقة السلوك التوزيعي العالمي لنماذج اللغات المقنعة عبر نمذجة إعادة أخذ عينات الرموز التكرارية كـسلسلة ماركوف من ديناميكيات غلاوبر، كاشفةً أنه في حين تؤدي أنظمة درجات الحرارة المرتفعة إلى خلط سريع، فإن ظروف درجات الحرارة المنخفضة تسبب حالة من عدم الاستقرار (metastability) وبطء التقارب بسبب حالات عدم التوافق الجوهرية في الشروط الشرطية المحلية للنماذج.

Suvadip Sana, Sami Wolf, Neer Mehta, Alina Shah, Aitzaz Shaikh, Janna Goodman, Lionel Levine2026-05-19
🤖 machine learning

An Information-Theoretic Criterion for Efficient Data Synthesis

تقترح هذه الورقة إطاراً نظرياً للمعلومات يوضح أن البيانات الاصطناعية تُحسّن النماذج اللغوية فقط عندما تكون حلقة التوليد "مفتوحة معلوماتياً" عبر إشارات خارجية، محاججةً بأن التعلم يتقارب نحو الإشارة الأكثر كفاءة من حيث المعلومات المتاحة — سواء كانت إشرافاً قوياً وفضفاضاً من أجل التعميم أو نمطاً زائفاً يؤدي إلى اختراق المكافأة.

Hanyu Li, Zhengqi Sun, Xiaotie Deng2026-05-19
🤖 AI

Mutual Enhancement Between Global Tokens and Patch Tokens: From Theory to Practice

مستلهماً من إنتروبيا المعلومات، تقترح الورقة البحثية TaTok، وهو إطار عمل لترميز الصور تكيفي ذو أساس نظري يجمع بين الرموز العالمية وخوارزمية تصفية ديناميكية للقضاء على التكرار وفقدان المعلومات، محققاً أداءً هو الأفضل في فئته مع تحسينات كبيرة في جودة الصورة وسرعة الاستنتاج.

Xiusheng Huang, Xin Jiang, Jun Zhao, Kang Liu, Yequan Wang2026-05-19
💬 NLP

Hilbert-Geo: Solving Solid Geometric Problems by Neural-Symbolic Reasoning

تقدم الورقة البحثية Hilbert-Geo، وهو إطار عمل عصبي-رمزي يوحد المدخلات اللغوية الطبيعية والبصرية في لغة صورية لتحقيق أداء رائد في حل مسائل الهندسة المستوية والصلبة المعقدة من خلال استدلال قابل للتحقق وقابل للقراءة من قبل البشر.

Ruoran Xu, Haoyu Cheng, Bin Dong, Qiufeng Wang2026-05-19
🤖 AI

Vision Transformer-Conditioned UNet for Domain-Adaptive Semantic Segmentation

تقدم الورقة البحثية ViTC-UNet، وهي بنية مبتكرة تسد فجوة الأداء لـ "محولات الرؤية" (Vision Transformers) في التجزئة الطبية الحيوية من خلال تكييف نموذج UNet بناءً على تمثيلات محولات الرؤية المجمدة عبر رموز قابلة للتعلم وفك تشفير ذي انتباه ثنائي الاتجاه، مما يجمع بفعالية بين الأولويات البصرية العالمية والتحيزات الاستقرائية المحلية لتحقيق نتائج رائدة عبر وسائط الرنين المغناطيسي والأشعة المقطعية دون الحاجة إلى ضبط دقيق شامل للنهاية.

Joel Valdivia Ortega, Tingying Peng, Marion Jasnin2026-05-19