🤖 machine learning

Statistical Consistency and Generalization of Contrastive Representation Learning

تؤسس هذه الورقة نظرية تعلم إحصائي موحدة لتعلم التمثيلات التباينية، حيث تثبت الاتساق الإحصائي لخسارة التباين مع الترتيب الأمثل، وتستنتج حدود التعميم التي تفسر فوائد مجموعات العينات السالبة الكبيرة، وتوفر رابطاً كمياً بين مخاطر التباين الزائدة وعدم المثالية في الاسترجاع.

Yuanfan Li, Xiyuan Wei, Tianbao Yang, Yiming Ying2026-05-29
🤖 machine learning

Bridging Classification and Reconstruction: Cooperative Time Series Anomaly Detection

تقترح هذه الورقة CoAD، وهو إطار عمل جديد وخفيف الوزن يوحد بين نماذج كشف القيم المتطرفة ونماذج الترميز التلقائي المقنع من خلال تصميم تعاوني للتغلب على قيود التعميم وعدم توافق القناع في الطرق الحالية، مما يحقق أداءً فائقاً في اكتشاف الشذوذ في السلاسل الزمنية الدقيقة والممتدة.

Qideng Tang, Dai Chaofan, Wubin Ma, Yahui Wu, Haohao Zhou, Tao Zhang, Huan Li, Dalin Zhang2026-05-29
💻 computer science

RightNow-Arabic-0.5B-Turbo: An Open Sub-1B Arabic Language Model via Vocabulary Injection and Edge-First Deployment

تقدم هذه الورقة البحثية نموذج RightNow-Arabic-0.5B-Turbo، وهو نموذج لغوي مفتوح المصدر متخصص في اللغة العربية بـ 518 مليون معلمة، تم بناؤه على نموذج Qwen2.5-0.5B من خلال حقن المفردات والضبط الدقيق المكثف، والذي يحقق أداءً هو الأفضل في فئته بين النماذج التي يقل عدد معلماتها عن مليار معلمة، مع تمكين النشر الفعال على الأجهزة الطرفية عبر التكميم إلى أقل من 400 ميجابايت.

Jaber Jaber, Osama Jaber2026-05-29
🤖 machine learning

One Mask to Rule Them All: On Hidden Facts after Editing and How to Find Them

تكشف هذه الورقة أن تعديلات المعرفة المتنوعة في نماذج المحولات (transformer models)، مثل ROME وMEMIT، تعتمد على فضاء فرعي وظيفي مشترك للأوزان يعمل على كبح الإفراط في الانتباه في الطبقات اللاحقة بدلاً من إعادة كتابة المعرفة، وهي آلية يمكن عزلها عبر قناع ثنائي لعكس التعديلات وتوجيه الدفاعات ضد التعديلات غير المرغوب فيها.

Ali Holmov, Paul Youssef, Nandi Schoots, Christin Seifert2026-05-29
💻 computer science

WASHH: An Anchor-Aware Whale-Guided Selection Hyper-Heuristic for Continuous Optimization and SVC Configuration

تقترح الورقة البحثية WASHH، وهو خوارزمية فوقية (hyper-heuristic) تعتمد على توجيه الحيتان ووعي المرساة، تدمج ديناميكيًا استراتيجيات بحث متعددة مع متحكم مكافأة عبر الإنترنت لتحقيق أداء فائق في مهام التحسين المستمر وتكوين خدمة المتجهات الداعمة (SVC) في ظل ميزانيات تقييم محدودة.

Yifu Zhao, Xiaofan Zou, Junhao Wei, Yanxiao Li, Baili Lu, Zhenhong Peng, Dexing Yao, Haochen Li, Qinbin He, Sio-Kei Im (…)2026-05-29
🤖 machine learning

Representation Signatures and Risk-Feedback Alignment in LLM Trading Agents

تقدم هذه الورقة TradeArena، وهو بيئة اختبار قابلة للتدقيق تثبت أن بصمات تمثيلية محددة — مثل انزياح التضمين وتقلص الرتبة الفعالة — يمكن أن تعمل كمؤشرات مبكرة لإخفاقات وكلاء التداول القائمين على النماذج اللغوية الكبيرة، بينما تكشف أيضاً أن التغذية الراجعة للمخاطر المهيكلة تحسن تشخيصات المواءمة دون أن تعزز الربحية بشكل عالمي.

Weicheng Xue2026-05-29
🔭 astrophysics

Towards a Foundation Model for the Martian Atmosphere

تحدد هذه الورقة ملامح التصميم لتطوير نموذج تأسيسي قائم على البيانات للغلاف الجوي للمريخ من خلال تحليل مصادر البيانات المتاحة، وتحديد التطبيقات المرشحة في المجالات اللاحقة، والاستفادة من التطورات الأخيرة في الذكاء الاصطناعي للتغلب على القيود الحسابية والرصدية لنماذج الدوران العام الحالية.

Sujit Roy, Udayshankar Nair, Yuling Wu, Georgios Priftis, Liping Wang, Anastasia Georgiou, Anne Jones, Björn Lütjens, Jo (…)2026-05-29
🤖 machine learning

Mechanistic origins of catastrophic forgetting: why RL preserves circuits better than SFT?

تقدم هذه الورقة مقياساً على مستوى الرأس يسمى "الضعف التفاضلي للدوائر" (differential circuit vulnerability) لتوضيح أنه بينما يعمل الضبط الدقيق الخاضع للإشراف على تكييف النماذج مع المهام الجديدة بشكل أسرع، فإن التعلم المعزز يحافظ بشكل أفضل على الدوائر الحسابية الداخلية، مما يقدم تفسيراً ميكانيكياً لمقاومته المتفوقة للنسيان الكارثي.

Jeanmely Rojas Nunez, Viraj Sawant, Nathan Allen, Nomgondalai Amgalanbaatar, Yannis Zongo, Vasu Sharma, Maheep Chaudhary2026-05-29
🤖 machine learning

Molecular Lead Optimization via Agentic Tool Planning

تقدم الورقة البحثية TRACE، وهو وكيل استدلال يعتمد على النماذج اللغوية الكبيرة (LLM) ومدرك للمسار، يعمل على تحسين عملية تحسين الرصاصات الجزيئية من خلال صياغة اختيار الأدوات كعملية اتخاذ قرار متسلسلة، مما يحقق تعزيزات فائقة في خصائص ADMET مع الحفاظ على التشابه الهيكلي مقارنة بالنهج التقليدي أحادي الخطوة.

Lingxiao Li, Haobo Zhang, Ruohao Fan, Bin Chen, Jiayu Zhou2026-05-29
🤖 machine learning

Self-Play Reinforcement Learning under Imperfect Information in Big 2

تقدم هذه الورقة إطار عمل للتعلم التعزيزي باللعب الذاتي للعبة الورق ذات المعلومات الناقصة "Big 2"، حيث تُظهر أن خوارزمية (PPO) تتفوق على الأساليب القائمة على القيمة في ظل ظروف محكومة، وتبرز فوائد تنظيم الإنتروبيا واللعب الذاتي للسياسة الحالية لتدريب وكلاء متعددين من الوكلاء المتينين.

Aalok Patwa2026-05-29