🤖 machine learning

One Mask to Rule Them All: On Hidden Facts after Editing and How to Find Them

تكشف هذه الورقة أن تعديلات المعرفة المتنوعة في نماذج المحولات (transformer models)، مثل ROME وMEMIT، تعتمد على فضاء فرعي وظيفي مشترك للأوزان يعمل على كبح الإفراط في الانتباه في الطبقات اللاحقة بدلاً من إعادة كتابة المعرفة، وهي آلية يمكن عزلها عبر قناع ثنائي لعكس التعديلات وتوجيه الدفاعات ضد التعديلات غير المرغوب فيها.

Ali Holmov, Paul Youssef, Nandi Schoots, Christin Seifert2026-05-29
💻 computer science

WASHH: An Anchor-Aware Whale-Guided Selection Hyper-Heuristic for Continuous Optimization and SVC Configuration

تقترح الورقة البحثية WASHH، وهو خوارزمية فوقية (hyper-heuristic) تعتمد على توجيه الحيتان ووعي المرساة، تدمج ديناميكيًا استراتيجيات بحث متعددة مع متحكم مكافأة عبر الإنترنت لتحقيق أداء فائق في مهام التحسين المستمر وتكوين خدمة المتجهات الداعمة (SVC) في ظل ميزانيات تقييم محدودة.

Yifu Zhao, Xiaofan Zou, Junhao Wei, Yanxiao Li, Baili Lu, Zhenhong Peng, Dexing Yao, Haochen Li, Qinbin He, Sio-Kei Im (…)2026-05-29
🤖 machine learning

Representation Signatures and Risk-Feedback Alignment in LLM Trading Agents

تقدم هذه الورقة TradeArena، وهو بيئة اختبار قابلة للتدقيق تثبت أن بصمات تمثيلية محددة — مثل انزياح التضمين وتقلص الرتبة الفعالة — يمكن أن تعمل كمؤشرات مبكرة لإخفاقات وكلاء التداول القائمين على النماذج اللغوية الكبيرة، بينما تكشف أيضاً أن التغذية الراجعة للمخاطر المهيكلة تحسن تشخيصات المواءمة دون أن تعزز الربحية بشكل عالمي.

Weicheng Xue2026-05-29
🔭 astrophysics

Towards a Foundation Model for the Martian Atmosphere

تحدد هذه الورقة ملامح التصميم لتطوير نموذج تأسيسي قائم على البيانات للغلاف الجوي للمريخ من خلال تحليل مصادر البيانات المتاحة، وتحديد التطبيقات المرشحة في المجالات اللاحقة، والاستفادة من التطورات الأخيرة في الذكاء الاصطناعي للتغلب على القيود الحسابية والرصدية لنماذج الدوران العام الحالية.

Sujit Roy, Udayshankar Nair, Yuling Wu, Georgios Priftis, Liping Wang, Anastasia Georgiou, Anne Jones, Björn Lütjens, Jo (…)2026-05-29
🤖 machine learning

Mechanistic origins of catastrophic forgetting: why RL preserves circuits better than SFT?

تقدم هذه الورقة مقياساً على مستوى الرأس يسمى "الضعف التفاضلي للدوائر" (differential circuit vulnerability) لتوضيح أنه بينما يعمل الضبط الدقيق الخاضع للإشراف على تكييف النماذج مع المهام الجديدة بشكل أسرع، فإن التعلم المعزز يحافظ بشكل أفضل على الدوائر الحسابية الداخلية، مما يقدم تفسيراً ميكانيكياً لمقاومته المتفوقة للنسيان الكارثي.

Jeanmely Rojas Nunez, Viraj Sawant, Nathan Allen, Nomgondalai Amgalanbaatar, Yannis Zongo, Vasu Sharma, Maheep Chaudhary2026-05-29
🤖 machine learning

Molecular Lead Optimization via Agentic Tool Planning

تقدم الورقة البحثية TRACE، وهو وكيل استدلال يعتمد على النماذج اللغوية الكبيرة (LLM) ومدرك للمسار، يعمل على تحسين عملية تحسين الرصاصات الجزيئية من خلال صياغة اختيار الأدوات كعملية اتخاذ قرار متسلسلة، مما يحقق تعزيزات فائقة في خصائص ADMET مع الحفاظ على التشابه الهيكلي مقارنة بالنهج التقليدي أحادي الخطوة.

Lingxiao Li, Haobo Zhang, Ruohao Fan, Bin Chen, Jiayu Zhou2026-05-29
🤖 machine learning

Self-Play Reinforcement Learning under Imperfect Information in Big 2

تقدم هذه الورقة إطار عمل للتعلم التعزيزي باللعب الذاتي للعبة الورق ذات المعلومات الناقصة "Big 2"، حيث تُظهر أن خوارزمية (PPO) تتفوق على الأساليب القائمة على القيمة في ظل ظروف محكومة، وتبرز فوائد تنظيم الإنتروبيا واللعب الذاتي للسياسة الحالية لتدريب وكلاء متعددين من الوكلاء المتينين.

Aalok Patwa2026-05-29
🤖 machine learning

TaxDistill: Improving Metagenomic Taxonomic Annotation via Distilled Genomic Foundation Models

يُعد TaxDistill إطار عمل لتقطير المعرفة يستفيد من نموذج جينومي تأسيسي ضخم (GenomeOcean) لتوليد تسميات ناعمة لتدريب شبكة طالب خفيفة الوزن، مما يقلل من الضجيج الناتج عن الطرق التقليدية القائمة على التشابه ويحسن بشكل كبير من دقة التصنيف التصنيفي للميتاجينوم عبر مجموعات بيانات متنوعة.

Rongye Ye, Lun Li, Zheng Luo, Yiran Zhan, Shuhui Song2026-05-29
🤖 machine learning

Pre-Registering the Detectable Effect: A Paired-MDE Budget for 4-bit Quantization Benchmarks, with a Pilot Audit

تقترح هذه الورقة ميزانية محافظة للحد الأدنى من التأثير القابل للكشف (MDE) مشتقة من حسابات حجم العينة الثنائية المزدوجة لمساعدة المصممين على تسجيل ادعاءات موثوقة لعمليات التكميم بـ 4 بت مسبقاً، حيث تثبت من خلال تدقيق تجريبي أن الكثير من تباين المعايير المذكور في العينات الفرعية الصغيرة هو في الواقع ضجيج ثنائي الحدين، وأن تباين قالب الأوامر غالباً ما يتجاوز تأثيرات التكميم.

Zexin Zhuang, Yanhang Li, Zhichao Fan2026-05-29
🤖 machine learning

Towards Continuous-time Causal Foundation Models

تقترح هذه الورقة نموذجاً تأسيسياً سببياً في الزمن المستمر يضمن ثبات قانون المسار تجاه جداول الملاحظة من خلال التكامل دقيق الشبكة مع الملاحظات المنفصلة، مما يظهر أداءً فائقاً مقارنة بطرق التكامل الساذجة عبر مختلف الديناميكيات غير الخطية وسيناريوهات البيانات غير المنتظمة.

Dennis Thumm, Ruben Wiedemann, Ying Chen2026-05-29