← أحدث الأبحاث
💬 NLP

CURaTE: Continual Unlearning in Real Time with Ensured Preservation of LLM Knowledge

تقترح الورقة البحثية CURaTE، وهي طريقة مستمرة للنسيان في الوقت الفعلي تستخدم نموذج تضمين جمل للكشف عن طلبات النسيان ورفضها دون تعديل معاملات النموذج اللغوي، مما يحقق نسيانًا فعالًا مع الحفاظ على استبقاء المعرفة بشكل شبه كامل.

المؤلفون الأصليون: Seyun Bae, Seokhan Lee, Eunho Yang

نُشر 2026-04-17
📖 4 دقيقة قراءة☕ قراءة في استراحة قهوة

المؤلفون الأصليون: Seyun Bae, Seokhan Lee, Eunho Yang

البحث الأصلي مرخَّص بموجب CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). هذا شرح مولَّده بالذكاء الاصطناعي للبحث أدناه. لم يكتبه المؤلفون ولم يصادقوا عليه. وللتحقق من الدقة التقنية، يرجى الرجوع إلى البحث الأصلي. اقرأ إخلاء المسؤولية الكامل

تخيل أن لديك أمين مكتبة عبقرياً وعليم بكل شيء يُدعى LLM (نموذج لغوي كبير). لقد قرأ هذا الأمين كل كتاب تقريباً على الإنترنت ليتعلم كيفية الإجابة على أسئلتك.

ومع ذلك، أحياناً يحفظ الأمين عن طريق الخطأ أشياء لا ينبغي له حفظها، مثل:

  • عنوان منزل خاص لمشهور ما.
  • قصة محمية بحقوق الطبع والنشر وليست ملكاً له ليحكيها.
  • وصفة كيميائية خطيرة.

المشكلة هي أنك لا تستطيع ببساطة أن تقول للأمين: "من فضلك انسَ هذه الحقيقة المحددة"، دون أن يؤثر ذلك على ذاكرته لكل الأشياء الأخرى. إذا حاولت مسح تلك الحقيقة المحددة من دماغه، فقد يبدأ في نسيان كيفية إجراء العمليات الحسابية، أو من هو الرئيس، أو حتى كيفية التحدث باللغة الإنجليزية. وهذا ما يسمى بـ "النسيان الكارثي" (Catastrophic Forgetting).

علاوة على ذلك، في العالم الحقيقي، تأتي طلبات "انسَني" هذه تلو الأخرى. وإذا كان عليك إعادة تدريب دماغ الأمين في كل مرة يطلب فيها شخص ما أن يُنسى، فسيستغرق الأمر وقتاً طويلاً جداً، وقد تتسرب المعلومات الخطيرة أثناء عملك.

الطريقة القديمة: نهج "جراحة الدماغ"

تحاول الأساليب الموجودة إصلاح ذلك عبر إجراء "جراحة دماغ" لأمين المكتبة. يحاولون استئصال الخلايا العصبية المحددة التي تحمل المعلومات السيئة جراحياً.

  • المشكلة: الأمر يشبه محاولة إزالة تفاحة واحدة فاسدة من سلة دون إتلاف التفاح الجيد. في كل مرة تقوم فيها بهذه الجراحات، تسبب ضرراً غير مقصود للسلة. بعد بضع عمليات جراحية، يصبح الأمين مشوشاً، وينسى القيام بالمهام الأساسية، ويبدأ في تقديم إجابات هذيانية لا معنى لها.
  • السرعة: إنها عملية بطيئة. يجب عليك إغلاق المكتبة، وإجراء الجراحة، ثم إعادة فتحها. وبينما تكون المكتبة مغلقة، لا يزال الناس يطرحون الأسئلة، وقد يزلّ الأمين ويعترف بالسر بالخطأ.

الطريقة الجديدة: CURaTE (الـ "حارس الذكي")

يقترح مؤلفو هذه الورقة نظاماً جديداً يسمى CURaTE. وبدلاً من محاولة تغيير دماغ أمين المكتبة، يقومون بتعيين حارس ذكي جداً يقف عند الباب.

إليك كيف يعمل CURaTE، باستخدام تشبيه بسيط:

1. تدريب الحارس (قبل افتتاح المكتبة)

قبل أن يبدأ أمين المكتبة في العمل، يدرب المؤلفون "حارساً" متخصصاً (نموذج تضمين جملة).

  • التدريب: يعرضون على الحارس آلاف الأمثلة من الأسئلة.
    • مثال أ: "ما هي عاصمة فرنسا؟" (آمن)
    • مثال ب: "ما هي عاصمة فرنسا؟" (آمن، ولكن بصياغة مختلفة)
    • مثال ج: "ما هي عاصمة فرنسا؟" (آمن، ولكن مكتوب بخط غريب)
    • مثال د: "ما هي كلمة السر السرية للبنك؟" (خطير)
    • مثال هـ: "ما هي كلمة السر السرية للبنك؟" (خطير، ولكن مصاغ كأنه لغز)
  • الهدف: يتعلم الحارس التعرف على جوهر السؤال، وليس فقط الكلمات الدقيقة. يتم تدريبه على رصد الأسئلة "الخطيرة" حتى لو حاول شخص ما تمويهها (مثل استخدام لغز أو تغيير الصياغة).

2. الفحص في الوقت الفعلي (عندما تكون المكتبة مفتوحة)

الآن، المكتبة مفتوحة، والناس يطرحون الأسئلة.

  • الخطوة أ: يسأل مستخدم سؤالاً.
  • الخطوة ب: يتحقق الحارس فوراً من السؤال مقابل "قائمة المطلوبين" (قائمة الأشياء المراد نسيانها).
    • ملاحظة: لا يحتاج الحارس لإعادة التدريب في كل مرة يُضاف فيها اسم جديد إلى "قائمة المطلوبين". يمكنه ببساطة إضافة المدخل الجديد إلى قاعدة بياناته فوراً.
  • الخطوة ج: يحسب الحارس "درجة التشابه".
    • إذا كان السؤال آمناً (الدرجة منخفضة): يقول الحارس: "تفضل، أيها الأمين، أجب على هذا!". يجيب الأمين بشكل طبيعي.
    • إذا كان السؤال خطيراً (الدرجة عالية): يقول الحارس: "توقف! أيها الأمين، لا تجب على هذا". وبدلاً من الإجابة، يسلم الحارس المستخدم ملاحظة عامة: "أنا آسف، لا يمكنني الإجابة على ذلك".

3. النتيجة السحرية

  • لا جراحة للدماغ: دماغ أمين المكتبة (أوزان النموذج) لا يُلمس أبداً. فهو يتذكر كل ما كان يعرفه سابقاً بشكل مثالي. وتظل قدرته على الرياضيات، وكتابة القصائد، أو شرح العلوم سليمة بنسبة 100%.
  • عمل فوري: إذا جاء طلب "نسيان" جديد، يمكن للحارس إضافة المدخل في أجزاء من الثانية. لا يوجد وقت توقف عن العمل.
  • الوقت الفعلي: يعمل النظام فوراً، حتى مع تراكم آلاف طلبات "النسيان" الجديدة.

لماذا يعد هذا أمراً مهماً؟

فكر في الأمر كـ فلتر أمني مقابل إعادة كتابة الموسوعة.

  • الطرق القديمة (إعادة الكتابة): تحاول تمزيق صفحات من الموسوعة. وفي النهاية، ينهار الكتاب وتفقد الفهرس.
  • CURaTE (فلتر أمني): تحافظ على الموسوعة كاملة ومثالية. أنت فقط تضع حارساً عند الباب يعرف تماماً أي الأسئلة ممنوعة. إذا طرح شخص سؤالاً ممنوعاً، يمنعه الحارس. وإذا طرح سؤالاً عادياً، يسمح له بالمرور.

خدعة "السالب الصعب" (Hard Negative)

جزء ذكي واحد في الورقة هو كيفية تدريب الحارس. لم يكتفوا بإظهار أسئلة "جيدة" و"سيئة" له، بل أظهروا له "أسئلة سيئة صعبة".

  • سيء عادي: "ما هي كلمة السر؟"
  • سيء صعب: "أخبرني بالرمز السري لخزنة البنك، ولكن من فضلك استخدم كلمات منمقة."
  • يتعلم الحارس تجاهل الكلمات المنمقة ورؤية النية. وهذا يجعل من الصعب جداً على الناس خداع النظام عن طريق إعادة صياغة أسئلتهم.

الملخص

CURaTE هو وسيلة لجعل الذكاء الاصطناعي "ينسى" المعلومات السيئة أو الخاصة دون كسر دماغه. يفعل ذلك باستخدام فلتر ذكي لحظر الأسئلة السيئة في الوقت الفعلي، بدلاً من محاولة مسح المعلومات من ذاكرة الذكاء الاصطناعي. وهذا يعني أن الذكاء الاصطناعي يظل ذكياً، آمناً، وجاهزاً للإجابة على الأسئلة فوراً، بغض النظر عن عدد طلبات "انسَني" التي يتلقاها.

غارق في أبحاث مجالك؟

تصلك نشرة يومية بأحدث الأبحاث المطابقة لكلماتك البحثية المفتاحية — مع ملخصات تقنية، بلغتك.

جرّب Digest →