🤖 machine learning

Continuous-Time Piecewise-Linear Recurrent Neural Networks

تقدم هذه الورقة الشبكات العصبية المتكررة ذات الخطية الجزئية في الزمن المستمر (cPLRNNs) التي تجمع بين الأداء العالي والقدرة على التتبع الرياضي للنماذج ذات الزمن المنفصل، مع القدرة على التعامل مع البيانات ذات الزمن المستمر والمأخوذة من عينات غير منتظمة، وذلك من خلال خوارزمية تدريب مبتكرة وتحديد شبه تحليلي للميزات الطوبولوجية.

Alena Brändle, Lukas Eisenmann, Florian Götz, Daniel Durstewitz2026-08-07
🤖 machine learning

TESSERA v2: Scaling Pixel-wise Earth Foundation Models

تقدم هذه الورقة أكبر دراسة تحكم في التوسع لنماذج التأسيس المعتمدة على بكسلات صور رصد الأرض، كاشفةً أن فقد التدريب المسبق يعد مؤشراً ضعيفاً للأداء في المهام اللاحقة، ومثبتةً قاعدة لتخصيص الحوسبة تتيح إنشاء نماذج طالب مدمجة وعالية الأداء تتفوق على المنتجات الحالية مع دعم تضمينات "ماتريوشكا" المرنة ومنخفضة التكلفة.

Zhengpeng Feng, Sadiq Jaffer, Ira Shokar, Jovana Knezevic, James Ball, Pedro Sousa, Mark Elvers, Madeline Lisaius, Cleme (…)2026-08-07
🤖 AI

The Ignition Index: Measuring Global Workspace Dynamics in Language Models

تقدم هذه الورقة "مؤشر الاشتعال" (Ignition Index)، وهو مقياس عددي تم التحقق من صحته يكمّم ظاهرة "الكل أو لا شيء" الخاصة بنظرية مساحة العمل العالمية في نماذج لغة المحولات، وذلك عبر تحليل انتقالات دقة المسبار السيني (sigmoidal probe accuracy transitions)، مما يكشف عن بصمات ديناميكية متميزة عبر البنيات ومراحل التدريب التي تميز المعالجة اللغوية الحقيقية عن الأنماط الزائفة.

Saman Rahbar2026-08-07
💬 NLP

SemiAdapt-Instruct: Extensible Instruction Tuning via Latent Domain-Specialised Adapters

يُعد SemiAdapt-Instruct إطار عمل نمطيًا يتيح ضبط التعليمات القابل للتوسع عبر اكتشاف المجالات الكامنة، وتدريب محولات LoRA متوازية لكل مجال، واستخدام التوجيه الخالي من المعلمات لدمج قدرات جديدة عبر تحديثات المحول المنفرد دون الحاجة إلى إعادة تدريب النموذج بالكامل.

Josh McGiff, Salma Mekaoui, Robert Shanahan, Nikola S. Nikolov2026-08-07
💬 NLP

Where Privacy Risk Lives in English-Source Multilingual RAG: A Stage-Decomposed Audit Across Five Query Languages

تتحدى هذه الورقة الافتراض القائل بأن الاستعلامات غير الإنجليزية تزيد بطبيعتها من مخاطر الخصوصية في أنظمة استرجاع المعلومات المعززة بالتوليد (RAG) متعددة اللغات ذات المصادر الإنجليزية، وذلك من خلال إثبات أن اللغة الإنجليزية تُظهر في الواقع أعلى معدلات تسريب معلومات الهوية الشخصية (PII) غير المهيكلة تحت نظام تصفية المخرجات فقط، عبر تدقيق مسار عمل نموذج Qwen2.5-7B، بينما تستمر المخاطر المتبقية في اللغتين العربية والسواحيلية حتى مع وجود قضاة للمدخلات والترجمة العكسية، رغم أنه يمكن التخفيف من حدتها إلى حد كبير من خلال تزويد قاضي المدخلات بسياق المستند.

Yanhang Li, Zhichao Fan, Zexin Zhuang2026-08-07
💬 NLP

Conditional Cognitive Biases in LLMs: How Biased User Turns Modulate In-Context Reasoning

تقيم هذه الورقة كيف تعمل مدخلات المستخدم المنحازة في المحادثات متعددة الأدوار على تعديل التعبير عن التحيز المعرفي في النماذج اللغوية الكبيرة المتطورة، كاشفةً أنه في حين أن التعرض الحواري يعزز التحيز بشكل عام، فإن إشارات التحيز الصريحة يمكن أن تفعّل آليات المواءمة التي تقمع التحيز العلني، وذلك بناءً على اختبار معياري شامل يضم أكثر من 24,000 مطالبة تم التحقق من صحتها عبر ثمانية نماذج.

Sachini Weerasekara, Sagar Kamarthi, Jacqueline Isaacs2026-08-07
🧬 biology

CLARA: Clarification of Language Ambiguity through Result Analysis for Natural-Language Cancer Genomics Queries

تقدم الورقة البحثية إطار عمل CLARA، الذي يحل الغموض في استعلامات علم جينوم السرطان باللغة الطبيعية من خلال تنفيذ تفسيرات متعددة وطلب التوضيح فقط عندما تتباين النتائج بشكل كبير، مما يوازن بفعالية بين السلامة وعبء المستخدم مع تحقيق دقة عالية في تحديد التباينات الحساسة للنتائج.

Pratyush Kumar Shukla, Manveer Singh Tib, Siddhant Garg2026-08-07
🤖 machine learning

MS-MLB: An Open Machine Learning Benchmark for Blood-Based MS Classification

تقدم هذه الورقة MS-MLB، وهو أول معيار مرجعي مفتوح وقابل لإعادة الإنتاج في تعلم الآلة لتصنيف التصلب المتعدد مقابل الأصحاء باستخدام بيانات التعبير عن الحمض النووي الريبوزي (RNA) من الدم الكامل من مجموعة بيانات GSE17048، والذي يتميز بمسار تقييم صارم ومتحكم في التسرب حدد تعزيز التدرج (Gradient Boosting) كأفضل خوارزمية أداءً.

Adam Simson, Ankush Dutta, Quang Bui2026-08-07
🤖 AI

SkillTrace: Multi-Trace Provenance Auditing for LLM-Agent Skill Reuse

تقدم هذه الورقة SkillTrace، وهو إطار عمل لتدقيق المنشأ متعدد المسارات يكتشف إعادة استخدام المهارات في الوكلاء القائمين على النماذج اللغوية الكبيرة عبر استخراج ومقارنة مسارات التعبير والتنفيذ والتشغيل (الممثلة كرسوم بيانية تشغيلية للمهارات)، محققاً دقة عالية في الاختبارات المعيارية وممكناً للمراجعة القابلة للتنفيذ في عمليات التدقيق الواسعة النطاق.

Jialuo Chen, Minghe Wang, Lingqi Jiang, Jianan Ma, Xinhao Deng, Xiaohu Du, Ruixiao Lin, Yunhao Feng, Linkang Du, Jingyi (…)2026-08-07
🤖 machine learning

When Do Corrective Features Help? An Agent for Corrective Feature Discovery on Black-Box Forecasters

تقدم الورقة البحثية CRAFTER، وهو وكيل غير مرتبط بمصدر محدد يعمل على تحسين المتنبئات ذات الصندوق الأسود المجمدة من خلال الاكتشاف التلقائي لميزات تصحيحية قابلة للتفسير من المدخلات الخام والفرضيات المولدة بواسطة النماذج اللغوية الكبيرة (LLM) لتوجيه مصحح لاحق خفيف الوزن، مما يقلل أخطاء التنبؤ بشكل كبير عبر مجموعات بيانات وهياكل متنوعة.

Fangxin Wang, Ziyi Zhang, Diyi Zhuang, Langzhou He, Shiyu Wang, Baichuan Mo, Philip S. Yu2026-08-07