💬 NLP

LatentRAG: Latent Reasoning and Retrieval for Efficient Agentic RAG

يُعد LatentRAG إطار عمل مبتكر ينقل استدلال واسترجاع الـ RAG الوكيل من الفضاء اللغوي المنفصل إلى الفضاء الكامن المستمر، مما يتيح التحسين المشترك من طرف إلى طرف ويقلل زمن انتقال الاستدلال بنسبة 90% تقريبًا مع الحفاظ على أداء مماثل للطرق الصريحة متعددة الخطوات.

Yijia Zheng, Marcel Worring2026-05-08
📊 statistics

Multimodal Deep Generative Model for Semi-Supervised Learning under Class Imbalance

تقترح هذه الورقة نموذجاً توليدياً عميقاً متعدد الأنماط للتعلم شبه الموجه تحت ظروف عدم توازن الفئات، والذي يستفيد من المتغيرات الكامنة المشتركة، وتوزيعات "ت" لستودنت (Student's t-distributions) لالتقاط خصائص البيانات ذات الذيول الثقيلة، ومعيار تباعد قوة "غاما" (γ\gamma-power divergence) للتفوق على الطرق الحالية في مجموعات البيانات متعددة الأنماط، غير متوازنة الفئات، والموسومة جزئياً.

Heegeon Yoon, Heeyoung Kim2026-05-08
📊 statistics

Attributions All the Way Down? The Metagame of Interpretability

تقدم هذه الورقة "اللعبة العليا" (metagame)، وهي إطار مفاهيمي يكمّم تأثيرات التفاعل من الدرجة الثانية في تفسيرات النماذج عبر معاملة طرق الإسناد كألعاب تعاونية لحساب الإسنادات العليا، مما يتيح تفكيكاً هرمياً للإسنادات ويقدم رؤى جديدة حول تفاعلات الرموز (tokens)، والتشابه عبر الوسائط، ومفاهيم تحويل النص إلى صورة عبر نماذج ذكاء اصطناعي متنوعة.

Hubert Baniecki, Przemyslaw Biecek, Fabian Fumagalli2026-05-08
🤖 machine learning

Molecules Meet Language: Confound-Aware Representation Learning and Chemical Property Steering in Transformer-VAE Latent Spaces

تُثبت هذه الورقة أنه بينما يمكن لفضاءات الكامن في نماذج Transformer-VAE غير الخاضعة للإشراف والمدربة على تمثيلات SELFIES أن تدعم توجيهاً ذا مغزى للخصائص الكيميائية، إلا أن هذا التحكم لا يكون صالحاً إلا عند التحقق منه بصرامة من خلال الجزيئات التي تم فك تشفيرها والتقييم الواعي للمتغيرات المربكة للتمييز بين الإشارات الكيميائية الحقيقية والآثار الاصطناعية على مستوى التسلسل.

Zakaria Elabid, Jan Andrzejewski, Bartosz Brzoza, Attila Cangi2026-05-08✓ Author reviewed
🤖 machine learning

Perceive, Route and Modulate: Dynamic Pattern Recalibration for Time Series Forecasting

تقدم هذه الورقة آلية إعادة المعايرة الديناميكية للأنماط (DPR)، وهي آلية خفيفة الوزن ومستقلة عن الهيكل الأساسي، تعمل على تعزيز التنبؤ بالسلاسل الزمنية من خلال التكيف ديناميكياً مع الأنماط الزمنية المحلية المتغيرة عبر مسار "الإدراك-التوجيه-التعديل"، وبذلك تتغلب على قيود التحويلات الثابتة والمشتركة عالمياً في النماذج العميقة الحالية.

Siru Zhong, Zhao Meng, Haohuan Fu, Haoyang Li, Qingsong Wen, Yuxuan Liang2026-05-08
🤖 machine learning

When Does 2\ell_2-Boosting Overfit Benignly? High-Dimensional Risk Asymptotics and the 1\ell_1 Implicit Bias

تُظهر هذه الورقة أن تعزيز 2\ell_2 يعاني من فرط التخصيص الحميد بمعدل لوغاريتمي بطيء بسبب انحياز 1\ell_1 الضمني الذي يعمل على تركيز الضجيج في مجموعات متفرقة، ولكنها تقترح قاعدة توقف مبكر خالية من الضبط تستعيد المثالية الشبيهة بـ Lasso للإشارات المحدودة بـ 1\ell_1.

Ye Su, Jian Li, Yong Liu2026-05-08
📊 statistics

End-to-End Identifiable and Consistent Recurrent Switching Dynamical Systems

تقدم هذه الورقة Ω\OmegaSDS، وهو مُقدِّر قائم على التدفق يُثبت إمكانية التحديد النظري لفئة واسعة من الأنظمة الديناميكية التبديلية غير الخطية المتكررة ويحقق الأمثلة للاحتمالية القصوى، وبذلك يتفوق على النهج التقليدية القائمة على المشفرات التلقائية التباينية (VAE) في فك التشابك ودقة التنبؤ.

Carles Balsells-Rodas, Zhengrui Xiang, Xavier Sumba, Yingzhen Li2026-05-08
🤖 machine learning

Pro-KLShampoo: Projected KL-Shampoo with Whitening Recovered by Orthogonalization

يُعد Pro-KLShampoo مُحسِّناً مبتكراً يعزز KL-Shampoo من خلال استغلال بنية القيم الذاتية "النبضية-المسطحة" (spike-and-flat) لمُهيئات مسبقة خاصة به، وذلك عبر الجمع بين التتبع الطيفي الكامل في فضاء جزئي منخفض الأبعاد والتعامد في الاتجاهات المتبقية، مما يحقق أداءً فائقاً في خسارة التحقق، وكفاءة الذاكرة، وسرعة التدريب عبر مقاييس متعددة للنماذج اللغوية الكبيرة (LLM).

Ruotong Sun, Ermin Wei2026-05-08
🤖 machine learning

SMolLM: Small Language Models Learn Small Molecular Grammar

تقدم الورقة البحثية نموذج SMolLM، وهو نموذج ترانسفورمر مدمج للغاية يتكون من 53 ألف معلمة، يتفوق على النماذج الأكبر في توليد سلاسل SMILES جزيئية صالحة من خلال تعلم تسلسل ثابت وقابل للتفسير من العمليات — الأقواس، والحلقات، والتكافؤ — لحل القيود الكيميائية.

Akhil Jindal, Harang Ju2026-05-08
🤖 machine learning

Gaming the Metric, Not the Harm: Certifying Safety Audits against Strategic Platform Manipulation

تُثبت هذه الورقة أن مقاييس السلامة القياسية قابلة للتلاعب بطبيعتها من قِبل المنصات الاستراتيجية التي تسعى لتحسين الدرجات بدلاً من تقليل الضرر الفعلي، وتقترح طريقة اعتماد "الغلاف الدلالي" التي تظل صامدة أمام هذا التلاعب عبر تعيين أسوأ درجة ممكنة ضمن الفئة المتكافئة دلالياً لكل متغير محتوى.

Florian A. D. Burnat, Brittany I. Davidson2026-05-08