🤖 machine learning

Contrastive Learning for Interpretable Anomaly Detection at Collider Experiments

تقدم الورقة البحثية إطار عمل ORCA، وهو إطار عمل ثنائي المراحل يجمع بين التعلم التبايني الخاضع للإشراف والمشفرات التلقائية (autoencoders) لتحقيق كل من تحسين الحساسية وقابلية التفسير في كشف الشذوذ في المصادمات، وذلك عبر رسم خرائط للأحداث في فضاء تضمين حيث يمكن عزو العينات الشاذة كمياً إلى عمليات فيزيائية معروفة.

Haoyi Jia, Sagar Addepalli, Julia Gonski2026-08-17
🤖 machine learning

The Query Knows What to Forget: A Second Erase Direction for Linear Attention

تقدم هذه الورقة "اتجاه المسح المستمد من الاستعلام" (QED)، وهي آلية مبتكرة للانتباه الخطي تضيف متجه مسح ثانٍ متعامد مع الاستعلام لحل تداخل الحالة وتمديد طول السياق القابل للاستخدام بشكل كبير بما يتجاوز نوافذ التدريب.

Dhruman Gupta, Aritra Das, Debayan Gupta2026-08-17
🤖 machine learning

From BERT to Frontier Agents: Eight Years of Language-Model Progress, the Collapse of the Capability-Cost Curve, and the Rise of Task-Targeted Models

تستعرض هذه الورقة التطور الممتد لثماني سنوات للنماذج اللغوية من "BERT" إلى الوكلاء المتخصصين في الطليعة بحلول عام 2026، مسلطة الضوء على تحسن سنوي بمقدار ستة أضعاف في قدرات البرمجة، وانهيار دراماتيكي في تكاليف الاستدلال كما يجسده نموذج "GPT 5.6 Luna" منخفض التكلفة، والتحول نحو النماذج المستهدفة للمهام والتي تتفوق في مجالات محددة مثل برمجة الواجهات الأمامية، وإدارة المستودعات، وعمليات الطرفية.

Pranav Kumar Kaliaperumal2026-08-17
💻 computer science

Language-Specific Gaps in AI Safety Training Datasets

تكشف هذه الورقة عن فجوات حرجة، وغالباً ما تكون غير معالجة، في أصل وتوصيف وتغطية تصنيف الأضرار لمجموعات بيانات تدريب سلامة الذكاء الاصطناعي عبر اللغات ذات الموارد المنخفضة والمتوسطة والعالية، مما يثبت أن هذه أوجه القصور الهيكلية — لا سيما في اللغات الأفريقية وفئات أضرار محددة — تقوض ادعاءات السلامة متعددة اللغات وتساهم في الثغرات المستمرة ضد هجمات كسر الحماية متعددة الأدوار.

Chialuka Prisca-Mary Onuoha, Bright Etornam Sunu, Rashidat Sikiru2026-08-17
🤖 machine learning

SAGE: Surrogate-gradient Adaptation via Attention-Guided Entropy for Spiking Transformers

تقدم هذه الورقة SAGE، وهي آلية تدرج بديل معدلة بالارتياب للنماذج المحولة ذات الشبكات العصبية النبضية، والتي تعمل على تكييف ميل التدرج ديناميكيًا أثناء التدريب باستخدام اعتلاج الانتباه الذاتي لتحقيق تحسينات مستمرة في الدقة مقارنة بالنماذج المرجعية ذات البدائل الثابتة دون تغيير نموذج الاستدلال.

Kiran Nair, Rodrigue Rizk, KC Santosh2026-08-17
⚡ electrical engineering

TRUE-Colon: Exposing a Consistent Transfer Asymmetry in Real-Time Polyp Detection

تقدم الورقة البحثية بروتوكول TRUE-Colon، وهو بروتوكول قياس يوضح أن نماذج اكتشاف السلائل (اللحميات) في الوقت الفعلي التي تم تدريبها على مقاطع مختارة تركز على الآفات تعاني من انهيار حاد في الأداء في إعدادات الإجراءات الكاملة في العالم الحقيقي، بينما تحافظ النماذج المدربة على إجراءات كاملة على دقة عالية مع رفض المحتوى غير المتعلق بالسلائل بفعالية، مما يدعو إلى التحول نحو بيانات الإجراءات الكاملة ومقاييس ذات صلة بالنشر في تطوير أنظمة التشخيص بمساعدة الحاسوب (CADe).

Sebastian Doerrich, Andreas Franz Schwab, Francesco Di Salvo, Shyam Nandan Rai, Hanh Huyen My Nguyen, Christian Ledig2026-08-17
🤖 machine learning

Capacity-Dependent Effects of Data Selection for Reasoning

تُثبت هذه الورقة أن فعالية اختيار البيانات القائم على الاحتمالية لضبط الاستنتاج الدقيق تعتمد على السعة، حيث تفيد البيانات ذات الاحتمالية العالية النماذج الأصغر مع تحقيق مكاسب أولية أسرع، بينما تحقق البيانات ذات الاحتمالية المنخفضة أداءً فائقاً على المدى الطويل للنماذج الأكبر.

Cuong Dang, Hoang Anh Just, Ruoxi Jia2026-08-17
💬 NLP

GALA: Generation-Aware Cross-Modal Alignment for Text-to-Time-Series Synthesis

يقدم GALA إطار عمل جديداً ذا مرحلتين يحقق أداءً هو الأفضل في فئته في مجال توليد السلاسل الزمنية من النصوص عبر توظيف محاذاة عابرة للأنماط مدركة للتوليد لإنشاء تضمينات وصفية مُحسّنة خصيصاً لتوجيه مولدات مطابقة التدفق، مما يؤدي في آن واحد إلى تحسين دقة الإشارة والالتزام بالنص.

Haochen Zhang, Gengwei Zhang, Laura Yao, Nicholas Knoz, Tianlong Chen2026-08-17
🧬 biology

Data-driven techniques for translational neuroscience and personalized neuro-health

تستعرض هذه المراجعة مجموعة واسعة من الأدوات التقنية القائمة على البيانات والمنظمة حول أربع ركائز منهجية للنهوض بعلوم الأعصاب الانتقالية والصحة العصبية الشخصية، وذلك من خلال تمكين الكشف عن التغيرات الدماغية المبكرة والخاصة بكل فرد وتطوير نماذج قابلة للتطبيق سريرياً للأمراض التنكسية العصبية.

Vishal Subedi, Shashipraba N. K. Rajakaruna, Pratyusha Sarkar, Subhankar Chattoraj, Anjali Khasa, Siddhartha Nandy, Hamz (…)2026-08-17
💬 NLP

Amplified Does Not Mean Predictive: Reasoning Behaviors in Thinking Models

تكشف هذه الورقة عن "فجوة تضخيم-رفع" (Amplification-Lift Gap) جوهرية في نماذج الاستدلال، حيث يعمل التدريب على تضخيم السلوكيات التأملية مثل التصحيح الذاتي والإقرار بعدم اليقين، وهي سلوكيات لا تتنبأ بالضرورة بالصحة، بينما يفشل في تعزيز السلوكيات عالية القيمة بشكل كافٍ مثل معايرة الثقة ومواءمة المعرفة.

Jean de Dieu Nyandwi, Leena Mathur, Yonatan Bisk, Robert Hawkins, Graham Neubig2026-08-17