💻 computer science

Heterogeneous Information-Bottleneck Coordination Graphs for Multi-Agent Reinforcement Learning

تقترح هذه الورقة رسومًا بيانية للتنسيق عبر عنق زجاجة المعلومات غير المتجانسة (HIBCG)، وهو إطار عمل مؤصل نظريًا لتعلم التعزيز متعدد الوكلاء التعاوني، يستخدم عنق زجاجة المعلومات الرسومي لاستخلاص مسبق متوافق مع المجموعة لاختيار الحواف بشكل مبدئي، ومبدأ ملء الفراغ لتخصيص سعة الرسائل بشكل أمثل.

Wei Duan, Junyu Xuan, En Yu, Xiaoyu Yang, Jie Lu2026-05-19
💻 computer science

Ablating Safety: Mechanisms for Removing Alignment in Language Models for Security Applications

تقترح هذه الورقة "استئصال السلامة" (Ablating Safety) كبروتوكول تقييم منضبط لمهام الأمن السيبراني المصرح بها، مبرهنةً على أنه في حين توفر طرق إسقاط الرفض البسيطة مكاسب أمنية ضئيلة مع مخاطر سلامة عالية، فإن التكيف المستهدف القائم على تقنية LoRA يمكن أن يحسن الأداء الأمني بشكل كبير مع الحفاظ على القدرات العامة والحد من تسرب عدم السلامة.

Isaac David, Arthur Gervais2026-05-19
🤖 machine learning

IVF-TQ: Streaming-Robust Approximate Nearest Neighbor Search via a Codebook-Free Residual Layer

تقترح الورقة البحثية IVF-TQ، وهو فهرس للبحث عن أقرب الجيران التقريبي المتين للتدفقات، والذي يستبدل كتب الرموز المدربة بتدوير عشوائي ثابت وتكميم قياسي محوسب مسبقاً للقضاء على مشكلة تقادم البيانات أثناء عملية استيعاب البيانات المستمرة مع الحفاظ على استدعاء تنافسي عبر مختلف ميزانيات الذاكرة.

Tarun Sharma2026-05-19
💻 computer science

Benchmarking Mythos-Linked Bug Rediscovery

تُبلغ هذه الورقة عن تجربة منضبطة حاولت فيها ثلاثة نماذج للذكاء الاصطناعي إعادة اكتشاف ستة أخطاء برمجية محددة مرتبطة بمواد "Mythos" الخاصة بشركة Anthropic دون معرفة مسبقة بالإصلاحات، مما كشف أنه حتى في ظل الظروف المواتية، حققت النماذج معدل نجاح منخفضًا فقط (6 من أصل 54 محاولة) بسبب ميلها إلى الالتزام بفرضيات تبدو منطقية ولكنها غير صحيحة بدلاً من تحديد الثابت المحدد الذي تم تصحيحه بواسطة الرقع البرمجية الفعلية.

Isaac David, Arthur Gervais2026-05-19
🤖 machine learning

Learning Displacement-Robust Representations for Landslide Early Warning under Rainfall Forecast Uncertainty

تقترح هذه الورقة نظاماً جديداً للإنذار المبكر من الانهيارات الأرضية يستخدم التعلم التبايني المدرك للأمطار والحركة لتوليد تمثيلات قوية تجاه الإزاحة من بيانات الأمطار والتضاريس، مما يحسن دقة التنبؤ بشكل كبير في ظل حالات عدم اليقين المكاني المتأصلة في توقعات هطول الأمطار.

Ren Ozeki, Hamada Rizk, Hirozumi Yamaguchi2026-05-19
🤖 machine learning

MATE: Solving Contextual Markov Decision Processes with Memory of Accumulated Transition Embeddings

تقترح الورقة البحثية MATE، وهي بنية ذاكرة تحل عمليات ماركوف لاتخاذ القرار السياقية عبر استبدال المعتقدات اللاحقة المستعصية بذاكرة مجمعة بالجمع، مما يحقق أداءً يضاهي نماذج التسلسل القياسية مع تجنب القيود الحسابية وقيود التدرج التي تفرضها نماذج المحولات (Transformers) والشبكات العصبية المتكررة (RNNs).

Himchan Hwang, Hyeokju Jeong, Gene Chung, Seungyeon Kim, Sangwoong Yoon, Frank Chongwoo Park2026-05-19
💻 computer science

Spatial Blindness in Whole-Slide Multiple Instance Learning

تحدد الورقة البحثية مشكلة "العمى المكاني" في نماذج تعلم الحالات المتعددة للشرائح الكاملة، حيث تعتمد التنبؤات على إحصائيات المظهر التركيبية بدلاً من البنية النسيجية بسبب ديناميكيات التحسين، وتقترح ResTopoMIL —وهي بنية بسيطة تفصل بين تعلم المظهر غير المتغير بالتبديل وبين التعلم المكاني المعتمد على الإحداثيات— لاستعادة الحساسية المكانية وتحسين الأداء عبر تسعة معايير مرجعية.

Xiangyu Li, Ran Su2026-05-19
💻 computer science

GCE-MIL: Faithful and Recoverable Evidence for Multiple Instance Learning in Whole-Slide Imaging

يُعد GCE-MIL إطار عمل غير مرتبط بهيكل محدد، يعمل على تعزيز التعلم متعدد الأمثلة لصور الشرائح الكاملة من خلال التحسين الصريح لمعايير الكفاية والضرورة والقابلية للاسترداد (S/N/R) لتوليد أدلة وفية وقابلة للاسترداد، مما يؤدي إلى تحسين أداء التصنيف وتقليص الفجوة بين درجات الانتباه المستمرة واختيارات الرقع المستمرة.

Xiangyu Li, Ran Su2026-05-19
💻 computer science

A Distributional View for Visual Mechanistic Interpretability: KL-Minimal Soft-Constraint Principle

تقترح هذه الورقة رؤية توزيعية للتفسير الآلي البصري تصيغ المهمة كمسألة تحسين لتقليل تباعد كولباك - ليبلر (KL) لمعالجة الانحيازات الإحصائية في النماذج القائمة، مقدمةً مبدأ القيد الناعم لتقليل تباعد كولباك - ليبلر الذي يتم تحقيقه من خلال أخذ عينات خلفية للانتشار موجهة بالطاقة لتحقيق توازن نظري بين القابلية للتفسير والأمانة.

Guancheng Zhou, Yisi Luo, Zhengfu He, Zhenyu Jin, Xuyang Ge, Wentao Shu, Deyu Meng, Xipeng Qiu2026-05-19
💻 computer science

SaaSBench: Exploring the Boundaries of Coding Agents in Long-Horizon Enterprise SaaS Engineering

تقدم هذه الورقة البحثية SaaSBench، وهو أول معيار اختبار صُمم لتقييم وكلاء البرمجة المستقلين في بيئات البرمجيات كخدمة (SaaS) المؤسسية المعقدة ومتعددة المكونات، كاشفةً أن العائق الرئيسي أمام النماذج المتطورة لا يكمن في توليد منطق الكود البرمجي، بل في النجاح في تهيئة ودمج مكونات الأنظمة غير المتجانسة.

Qingnan Ren, Shun Zou, Shiting Huang, Ziao Zhang, Kou Shi, Zhen Fang, Yiming Zhao, Yu Zeng, Qisheng Su, Lin Chen, Yong W (…)2026-05-19