← أحدث الأبحاث
🤖 AI

ICCU: In-Context Continual Unlearning via Pattern-Induced Refusal Rules

تقدم هذه الورقة البحثية إطار عمل ICCU، وهو إطار عمل خالٍ من المعلمات لتعلم إلغاء مستمر، يقوم باستحثاث وتراكم قواعد رفض مقروءة من مجموعات بيانات إلغاء التعلم لقمع المعرفة المستهدفة بفعالية وقت الاستدلال مع الحفاظ على فائدة النموذج وتجنب التداخل بين الطلبات المتقاطعة.

المؤلفون الأصليون: Ruihao Pan, Suhang Wang

نُشر 2026-05-27
📖 4 دقيقة قراءة☕ قراءة في استراحة قهوة

المؤلفون الأصليون: Ruihao Pan, Suhang Wang

البحث الأصلي مرخَّص بموجب CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). هذا شرح مولَّده بالذكاء الاصطناعي للبحث أدناه. لم يكتبه المؤلفون ولم يصادقوا عليه. وللتحقق من الدقة التقنية، يرجى الرجوع إلى البحث الأصلي. اقرأ إخلاء المسؤولية الكامل

تخيل أن لديك أمين مكتبة ذكيًا جدًا ومطلعًا (نموذج ذكاء اصطناعي) قد حفظ ملايين الكتب. في أحد الأيام، يأتي شخص ويقول له: "من فضلك، أريدك أن تنسى تمامًا قصة شخصيتي الخيالية، 'جون دو'، لأنني لا أريد أن يعرف أحد عنه بعد الآن".

في الماضي، إذا أردت من أمين المكتبة أن ينسى هذا، كان عليك تفكيك المكتبة بأكملها، ونزع كل صفحة تذكر "جون دو"، ثم إعادة ترتيب الكتب على الرفوف. إذا جاء عشرة أشخاص في الأسبوع التالي ومعهم عشرة طلبات مختلفة من نوع "انسَني"، فسيكون عليك القيام بهذه العملية المؤلمة والمكلفة عشر مرات. والأسوأ من ذلك، أنه في كل مرة تعيد فيها تنظيم الرفوف، قد تفسد بالخطأ تنظيم الكتب الأخرى، مما يجعل أمين المكتبة أبطأ أو أقل فائدة للجميع.

تقدم هذه الورقة البحثية طريقة ذكية وجديدة للتعامل مع طلبات "انسني" هذه تسمى ICCU. فبدلاً من إعادة ترتيب المكتبة، تعمل ICCU كـ حارس أمن ذكي يقف عند الباب الأمامي.

الفكرة الجوهرية: "كتاب القواعد" بدلاً من المكتبة

إليك كيف تعمل ICCU باستخدام تشبيه بسيط:

1. طلب "النسيان" (النمط)
عندما يطلب شخص ما من أمين المكتبة نسيان "جون دو"، لا تبحث ICCU في كل كتاب على حدٍ سواء. بدلاً من ذلك، تنظر إلى نوع المعلومات المتعلقة بجون دو. فهي تجمع الحقائق المتشابهة معًا (مثل "مكان ولادة جون"، "طعام جون المفضل"، "وصفة جون السرية").

2. كتابة "قاعدة الرفض"
بعد ذلك، تطلب ICCU من ذكاء اصطناعي فائق الذكاء كتابة قاعدة بسيطة ومفهومة للبشر بناءً على هذه المجموعات.

  • الطريقة القديمة: "احذف كل ملف يحتوي على كلمات 'جون دو'".
  • طريقة ICCU: "إذا سأل مستخدم عن تعليمات مفصلة حول كيفية خبز كعكة خيالية معينة، قل 'لا يمكنني الإجابة على ذلك'".

هذه القاعدة تشبه الملاحظة اللاصقة؛ فهي قصيرة، سهلة القراءة، ولا تتطلب تمزيق المكتبة.

3. "حارس الأمن" عند الباب (وقت الاستنتاج)
الآن، تخيل أن مستخدمًا يسأل أمين المكتبة سؤالًا.

  • الخطوة 1 (الفحص السريع): يتحقق حارس الأمن (ICCU) بسرعة من سؤال المستخدم مقابل قائمة من "المراكز" (مثل الرادار). إذا كان السؤال يتعلق بوضوح بشيء آمن (مثل "ما هي حالة الطقس؟")، فإنه يسمح له بالمرور فورًا. لا حاجة لقواعد هنا.
  • الخطوة 2 (الفحص العميق): إذا بدا السؤال مريبًا بعض الشيء (ربما يتعلق بتلك الكعكة الخيالية)، فإن الحارس يخرج "قواعد الرفض" المحددة (الملاحظات اللاصقة) ويسأل أمين المكتبة: "هل يتطابق هذا السؤال مع أي من قواعد 'عدم الإجابة' لدينا؟"
  • النتيجة: إذا تطابق، يقول الحارس: "أنا آسف، لا يمكنني الإجابة على ذلك". وإذا لم يتطابق، يجيب أمين المكتبة بشكل طبيعي.

لماذا يعد هذا تحولاً جذريًا؟

تسلط الورقة الضوء على خمس قدرات خارقة لهذا النهج الجديد:

  • لا إعادة ترميم (بدون إعادة تدريب): أنت لا تحتاج أبدًا لإعادة بناء المكتبة. أنت فقط تضيف ملاحظة لاصقة جديدة إلى لوحة كتابة الحارس. وهذا يوفر كميات هائلة من الوقت والمال.
  • لا فوضى (لا تداخل بين المهام): إذا طلب 100 شخص نسيان 100 شيء مختلف، فأنت فقط تضيف 100 ملاحظة لاصقة. لا يرتبك الحارس. في الطرق القديمة، كان إضافة طلب "نسيان" جديد يؤدي غالبًا إلى جعل أمين المكتبة ينسى أشياء أخرى كان من المفترض أن يتذكرها. تمنع ICCU هذا "الخلط في الذاكرة".
  • درع "إعادة الصياغة": إذا حاول شخص خداع الحارس عبر السؤال عن "كيف أصنع تلك الكعكة؟" بدلاً من "أخبرني عن كعكة جون دو"، فإن الحارس ذكي بما يكفي ليعرف أنهما نفس الشيء. إنه يفهم المعنى، وليس فقط الكلمات الدقيقة. كما أنه يعمل حتى لو طُرح السؤال بلغة مختلفة.
  • صديقة للخصوصية: بمجرد أن يكتب الحارس القاعدة ("لا تتحدث عن كعكة جون دو")، يتم التخلص من القائمة الأصلية لأسرار جون دو. يحتفظ الحارس فقط بالقاعدة، وليس بالبيانات الحساسة نفسها.
  • مرنة: يمكنك استخدام الحارس كمرشح منفصل (للتحقق من السؤال قبل وصوله إلى أمين المكتبة) أو يمكنك إعطاء أمين المكتبة كتاب القواعد مباشرة ليتمكن من اتخاذ قراره بنفسه.

النتائج

اختبر الباحثون هذا النهج في سيناريوهات واقعية تتعلق بالمعرفة الخطيرة (مثل كيفية صنع مواد كيميائية ضارة) والقصص الخيالية. ووجدوا أن:

  • نجح الحارس في منع الذكاء الاصطناعي من الكشف عن المعرفة "المحظورة" بنسبة تقتر% من المرات.
  • ظل الذكاء الاصطناعي مفيدًا وذكيًا تمامًا لجميع الأسئلة الأخرى.
  • عمل الأمر بشكل مثالي حتى عندما تأتي طلبات "النسيان" الواحد تلو الآخر، دون أن يرتبك الذكاء الاصطناعي أو يفقد ذكاءه العام.

باختصار، تحول ICCU المهمة الصعبة لـ "محو التعلم" إلى مهمة بسيطة تتمثل في "كتابة واتباع القواعد"، مما يجعل من الممكن الحفاظ على سلامة الذكاء الاصطناعي وامتثاله دون كسر قدراته.

غارق في أبحاث مجالك؟

تصلك نشرة يومية بأحدث الأبحاث المطابقة لكلماتك البحثية المفتاحية — مع ملخصات تقنية، بلغتك.

جرّب Digest →