← أحدث الأبحاث
🤖 machine learning

Proteus: Incremental Memory Activation for Long-Context Sequence Modeling

تقدم الورقة البحثية "Proteus"، وهو نموذج جديد للتنشيط التدريجي للذاكرة يعمل على توسيع سعة الذاكرة الفعالة بشكل تصاعدي للتخفيف من تداخل الرموز المبكر وتحسين القدرة على الاستبقاء، مما يظهر مكاسب أداء ثابتة عبر مختلف النماذج الرائدة ذات السياق الطويل.

المؤلفون الأصليون: Reza Bayat, Ali Behrouz, Vahab Mirrokni, Aaron Courville

نُشر 2026-08-18
📖 4 دقيقة قراءة☕ قراءة في استراحة قهوة

المؤلفون الأصليون: Reza Bayat, Ali Behrouz, Vahab Mirrokni, Aaron Courville

البحث الأصلي مرخَّص بموجب CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). هذا شرح مولَّده بالذكاء الاصطناعي للبحث أدناه. لم يكتبه المؤلفون ولم يصادقوا عليه. وللتحقق من الدقة التقنية، يرجى الرجوع إلى البحث الأصلي. اقرأ إخلاء المسؤولية الكامل

في المشهد الواسع للذكاء الاصطناعي، ظل تحدٍ مستمر لفترة طويلة يحدد حدود ما يمكن للآلات تذكره. لسنوات، اعتمدت الأنظمة الأكثر قوة على آلية تعاملت مع كل قطعة من المعلومات التي تواجهها بوزن متساوٍ، حيث خُزنت سجلات كاملة وغير متغيرة لكل ما قرأته على الإطلاق. وبينما سمح هذا النهج بدقة مذهلة في استرجاع التفاصيل المحددة، إلا أنه جاء بثمن باهظ: فكلما زادت المعلومات التي يعالجها النظام، أصبح الأمر أكثر تكلفة من الناحية الحسابية، مما أدى في النهاية إلى تباطؤ حركته عند مواجهة قصص طويلة أو وثائق معقدة. ولحل هذه المشكلة، لجأ الباحثون إلى استراتيجية مختلفة، حيث صمموا نماذج تضغط التاريخ في ملخص واحد ثابت الحجم. جعلهم هذا سريعين وفعالين، لكنه قدم مشكلة جديدة؛ فبما أن مساحة الذاكرة كانت مفتوحة بالكامل دائمًا منذ اللحظة الأولى، مال النظام إلى الامتلاء بالتفاصيل الأولى التي رآها، مما ترك مجالاً ضئيلاً للمعلومات الجديدة التي تصل لاحقًا. وكانت النتيجة آلة تتذكر بداية المحادثة بشكل مثالي ولكنها تجد صعوبة في التمسك بالنهاية.

لقد اقترح فريق من الباحثين الآن حلاً لهذا الخلل، مقدمين طريقة يسمونها "التنشيط التدريجي للذاكرة". فبدلاً من إبقاء بنك الذاكرة بأكره مفتوحاً ومتاحاً منذ البلة، يقوم نهجهم بفتح الذاكرة تدريجياً مع نمو تسلسل المعلومات. تخيل مكتبة تكون فيها الأرفف مغلقة في البداية، مما يجبر أمين المكتبة على تلخيص الكتب القليلة الأولى في مساحة صغيرة وضيقة. ومع وصول المزيد من الكتب، يتم فتح أرفف جديدة، مما يوفر مساحة جديدة للقصص اللاحقة دون مسح ملخصات القصص السابقة. هذا التحول البسيط في التوقيت يجبر النظام على ضغط السياق المبكر بفعالية، مع ضمان وجود مساحة للمعلومات اللاحقة لتخزينها دون التداخل مع ما سبقها. وقد اختبر الباحثون هذه الفكرة على العديد من النماذج الأكثر تقدماً القائمة على الذاكرة والموجودة حالياً، ووجدوا أنها حسنت باستمرار قدرتها على فهم النصوص الطويلة واسترجاع تفاصيل محددة من أعماقها.

يعالج جوهر هذا العمل نمط فشل محدد في كيفية تعلم هذه الآلات. فعندما يُسمح للنموذج باستخدام كامل سعة ذاكرته على الفور، فإن القطع الأولى من المعلومات التي يواجهها لا تواجه أي منافسة على المساحة. يمكنها أن تستحوذ على قدر غير متناسب من انتباه النظام، مما يؤدي فعلياً إلى "تلوث" حالة الذاكرة. وبحلول الوقت الذي تصل فيه المعلومات اللاحقة، تكون الذاكرة قد تشبعت بالفعل، ويجب على التفاصيل الجديدة أن تحشر نفسها، مما يؤدي غالباً إلى الكتابة فوق البيانات السابقة أو تشويهها. ويرى الباحثون أن هذا النهج الثابت ليس مثالياً. إذ يقدم نموذجهم الجديد، المسمى "بروتيوس" (Proteus)، جدولاً ديناميكياً حيث لا تكون السعة الفعلية للذاكرة ثابتة بل تنمو بالتوازي مع طول المدخلات. في بداية التسلسل، يُجبر النظام على العمل بمجموعة فرعية مقيدة من ذاكرته، مما يعمل كعنق زجاجة يشجع على تلخيص السياق الأولي وضغطه بدلاً من حفظه بالتفصيل. ومع استمرار التسلسل، يتم فتح كتل إضافية من الذاكرة تدريجياً، مما يوفر سعة جديدة للمعلومات الجديدة. وهذا يضمن أن الرموز (tokens) اللاحقة لن تضطر للقتال من أجل المساحة ضد الرموز الأولى، مما يقلل التداخل ويحسن الاحتفاظ بالسياق الأحدث.

لاختبار هذا المفهوم، طبق الفريق آلية "بروتيوس" على مجموعة متنوعة من النماذج المتطورة، بما في ذلك بنيات معروفة مثل SWLA وComba وTitans وHope-Attention. تم تدريب هذه النماذج على مجموعات بيانات ضخمة تحتوي على مليارات الكلمات، حيث قارن الباحثون أداءها مع وبدون نظام البوابات الجديد. وأظهرت النتائج نمطاً واضحاً ومتسقاً: إضافة "بروتيوس" حسنت أداء النماذج في جميع المجالات. وفي مهام اللغة القياسية، أنتجت النماذج تنبؤات أكثر دقة ودرجات استدلال أفضل. وكانت التحسينات ملحوظة بشكل خاص في سيناريوهات السياق الطويل. فعندما طُلب منها استرجاع معلومة محددة مخبأة داخل وثيقة طويلة جداً — وهي مهمة تُعرف غالباً باسم "إبرة في كومة قش" — حافظت النماذج التي تستخدم "بروتيوس" على دقتها بشكل أفضل بكثير من نظيراتها القياسية مع زيادة طول النص. على سبيل المثال، في المهام التي تتضمن وثائق تصل إلى 16,000 كلمة، أظهرت النماذج التي تستخدم جدول التنشيط التدريجي مكاسب كبيرة في العثور على المعلومات الصحيحة، بينما شهدت النماذج المرجعية تدهوراً حاداً في أدائها.

كما استكشفت الدراسة كيف يمكن تطبيق هذا المبدأ بما يتجاوز مجرد حالة ذاكرة النموذج، ليمتد إلى المعلمات الداخلية للنموذج نفسه. ومن خلال معاملة عملية تعلم الطبقات الداخلية للنموذج كشكل من أشكال الذاكرة، طبق الباحثون نفس منطق الجدولة على كيفية تحديث النموذج لمعرفته الخاصة. سمح هذا التوسع باستخدام الطريقة في البنيات التي لا تعتمد على حالة ذاكرة متكررة تقليدية، مما أثبت بشكل أكبر مرونة النهج. وعبر جميع التجارب، لم تتطلب الطريقة أي تخزين إضافي للذاكرة أو تكلفة حسابية إضافية؛ بل قامت ببساطة بتغيير توقيت السماح لأجزاء مختلفة من النظام بالمشاركة في التعلم والاسترجاع. وتشير النتائج إلى أن الطريقة التي يتم بها تخصيص السعة بمرور الوقت لا تقل أهمية عن البنية نفسها. ومن خلال معاملة الذاكرة ليس كمورد ثابت، بل كجدول يتطور مع السياق، قدم الباحثون أداة بسيطة وقابلة للتطبيق على نطاق واسع تساعد الآلات على إدارة التسلسلات الطويلة بشكل أكثر فعالية، مما يثبت أنه في بعض الأحيان، أفضل طريقة لتذكر كل شيء هي فتح الأبواب ببطء.

غارق في أبحاث مجالك؟

تصلك نشرة يومية بأحدث الأبحاث المطابقة لكلماتك البحثية المفتاحية — مع ملخصات تقنية، بلغتك.

جرّب Digest →