🤖 machine learning

Balancing Fairness, Privacy, and Accuracy: A Multitask Adversarial Framework for Centralized Data-Driven Systems

تقترح هذه الورقة إطار عمل تنافسي متعدد المهام ومبتكر يعمل في آن واحد على تحسين العدالة والخصوصية والدقة في الأنظمة المركزية القائمة على البيانات، وذلك عبر تعلم تمثيلات كامنة تخفي السمات الحساسة مع الحفاظ على المعلومات ذات الصلة بالمهام، مما يحقق معايير أخلاقية ومعايير خصوصية عالية دون فقدان كبير في الأداء.

Imesh Ekanayake, Elham Naghizade, Jeffrey Chan2026-05-26
🤖 AI

SAM: State-Adaptive Memory for Long-Horizon Reasoning Agent

تقترح الورقة البحثية "الذاكرة المتكيفة مع الحالة" (SAM)، وهي إطار عمل مستقل يعزز الاستدلال الوكيل طويل المدى من خلال دمج سجلات التفاعل في إشارات ذاكرة مدمجة وموجهة نحو القصد تسمح للوكلاء بإعادة بناء المعلومات البعيدة ديناميكيًا دون إعادة تدريب النموذج الأساسي، مما يحقق أداءً فائقًا عبر معايير قياسية متنوعة.

Yuyang Hu, Hongjin Qian, Shuting Wang, Jiongnan Liu, Ziliang Zhao, Jiejun Tan, Zheng Liu, Zhicheng Dou2026-05-26
🤖 AI

AgentFugue: Agent Scaling for Long-Horizon Tasks through Collective Reasoning

تقدم الورقة البحثية AgentFugue، وهو إطار عمل للتفكير الجماعي يعزز أداء المهام طويلة الأمد من خلال ربط الوكلاء الأقران المتوازيين عبر مركز تفكير مشترك يسجل ويسهل إعادة استخدام الاكتشافات الوسيطة، مما يثبت أن التوسع الأفقي لأنظمة الوكلاء يمكن أن يحقق مكاسب نوعية في القدرات تتجاوز مجرد التوسع في الحوسبة.

Yuyang Hu, Hongjin Qian, Shuting Wang, Jiongnan Liu, Tong Zhao, Xiaoxi Li, Zheng Liu, Zhicheng Dou2026-05-26
🧬 biology

TIGER: Text-Informed Generalized Enzyme-Reaction Retrieval

تقدم الورقة البحثية TIGER، وهو إطار عمل مستند إلى النصوص يستفيد من نماذج توليد البروتين إلى نص وشبكة بوابات ديناميكية لإنشاء تمثيلات عامة للإنزيمات، مما يتفوق بشكل كبير على الأساليب الحالية في استرجاع العلاقة ثنائية الاتجاه بين الإنزيم والتفاعل عبر توزيعات ومهام متنوعة.

Yuhang Zhang, Keyan Ding, Peilin Chen, Han Liu, Can Lin, Ruixi Chen, Shiqi Wang, Qi Song2026-05-26
💻 computer science

Adaptive Punishment for Cooperation in Mixed-Motive Games

تقترح هذه الورقة "العقاب التكيفي للتعاون" (APC)، وهي طريقة موزعة تعمل على ضبط شدة العقاب ديناميكيًا بناءً على شدة الاحتمالية ودرجة الانحراف، وذلك لموازنة التكلفة والفعالية بشكل فعال، مما يعزز التعاون في سيناريوهات متعددة الوكلاء ذات الدوافع المختلطة.

Min Tang, Fanqi Kong, Linyuan Lü, Xue Feng2026-05-26
🤖 AI

Hypothesis Generation and Inductive Inference in Children and Language Models

تقارن هذه الورقة بين الأطفال البشر والوكلاء القائمين على النماذج اللغوية الكبيرة في مهمة استدلال استقرائي، كاشفةً أنه بينما يتكيف كلاهما بشكل مماثل مع عدم اليقين البيئي وموثوقية الأدلة من خلال آليات حوسبية متميزة، تُظهر النماذج اللغوية الكبيرة نزعات فريدة نحو الإفراط في الملاحظة والامتثال للتعليمات مقارنة بالأطفال.

Jeffrey Qin, Wasu Top Piriyakulki, Zhuangfei Gao, Mia Radovanovic, Jessica Sommerville, Kevin Ellis, Marta Kryven2026-05-26
💻 computer science

AI-Driven Adaptive Adversaries and the Erosion of Cryptographic Trust in Public Key Systems

تتقصى هذه الورقة كيف تعمل الخصوم التكيفية المدفوعة بالذكاء الاصطناعي على تقويض تشفير المفتاح العام من خلال استغلال الملاحظات القابلة للرصد على مستوى التنفيذ، مما يكشف عن عدم تطابق حرج بين نماذج الأمن التقليدية التي تركز على الخوارزميات وبين واقع الهجمات التشغيلية الحديثة.

Petar Radanliev2026-05-26
🤖 machine learning

Rethinking Federated Unlearning via the Lens of Memorization

تقترح هذه الورقة البحثية تقنية "تقليم الذاكرة الاتحادية" (FedMemPrune)، وهي نهج اتحادي جديد للتعلم غير المكتسب يستفيد من مقياس جديد لـ "تقييم الذاكرة المجمعة" للتمييز بين المعلومات المحفوظة الفريدة وإزالتها مع الحفاظ على الأنماط المتداخلة، مما يحقق تعلماً غير مكتسب فعالاً دون المساس بجدوى النموذج.

Jiaheng Wei, Yanjun Zhang, He Zhang, Leo Yu Zhang, Chao Chen, Kok-Leong Ong, Jun Zhang, Yang Xiang2026-05-26
🤖 AI

Jailbreak to Protect: Buffering and Reinforcing via Temporary Jailbreaking for Safe Fine-Tuning in Large Language Models

تقترح هذه الورقة إطار عمل للضبط الدقيق يعتمد على "التخزين المؤقت والتعزيز" (Buffer-and-Reinforce)، والذي يستخدم محولات كسر الحماية المؤقتة لتخزين التدرجات الضارة مؤقتاً ثم تعزيز محاذاة السلامة عبر الدمج القائم على تفكيك القيم المفردة (QR decomposition)، مما يحمي النماذج اللغوية الكبيرة من هجمات الضبط الدقيق الضارة دون الحاجة إلى بيانات سلامة إضافية أو عبء حوسبي كبير.

Seokil Ham, Jaehyuk Jang, Wonjun Lee, Changick Kim2026-05-26
🤖 machine learning

PILOT: Policy-Informed Learned Optimization for Adaptive Deep Network Training

تقدم هذه الورقة PILOT، وهو مُحسِّن عبر الإنترنت تكيفي يقوم بضبط سلوك التحديث ديناميكيًا بناءً على الاتفاق في اتجاه التدرج لتحسين استقرار التدريب وتحقيق دقة فائقة على FashionMNIST وCIFAR-10 مقارنة بالطرق الحالية.

Sattam Altuuaim, Lama Ayash, Muhammad Mubashar, Naeemullah Khan2026-05-26