← أحدث الأبحاث
💻 computer science

MirrorMark: A Distortion-Free Multi-Bit Watermark for Large Language Models

تُعد MirrorMark تقنية جديدة للعلامات المائية متعددة البتات لنماذج اللغات الكبيرة، حيث تقوم بتضمين رسائل قوية وقابلة للكشف دون تشويه توزيع احتمالية الرموز (tokens)، مما يحافظ على جودة النص مع التفوق بشكل كبير على الأساليب الحالية في معدلات الدقة والكشف.

المؤلفون الأصليون: Ya Jiang, Massieh Kordi Boroujeny, Surender Suresh Kumar, Kai Zeng

نُشر 2026-04-28
📖 4 دقيقة قراءة☕ قراءة في استراحة قهوة

المؤلفون الأصليون: Ya Jiang, Massieh Kordi Boroujeny, Surender Suresh Kumar, Kai Zeng

البحث الأصلي مرخَّص بموجب CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). هذا شرح مولَّده بالذكاء الاصطناعي للبحث أدناه. لم يكتبه المؤلفون ولم يصادقوا عليه. وللتحقق من الدقة التقنية، يرجى الرجوع إلى البحث الأصلي. اقرأ إخلاء المسؤولية الكامل

تخيل أنك خباز ابتكرت للتو وصفة مثالية للخبز. تريد التأكد من أنه إذا قام شخص ما ببيع خبزك باسمه الخاص، يمكنك إثبات أنه ملكك. ولكن هناك عقبة: لا يمكنك مجرد وضع ختم ضخم بكلمة "مِلكي" على الرغيف، لأن ذلك سيفسد المظهر والمذاق. ولا يمكنك مجرد الهمس بشفرة سرية داخل العجين، لأنك إذا قطعت شريحة أو أضفت فتاتاً، فستضيع الهمسة.

هذه هي المشكلة التي يحلها MirrorMark لنماذج اللغات الكبيرة (LLMs) — وهي أنظمة الذكاء الاصطناعي التي تكتب النصوص لنا.

إليك كيف يعمل MirrorMark، مقسماً إلى مفاهيم بسيطة:

1. المشكلة في "العلامات المائية" الحالية

فكر في طرق العلامات المائية الحالية كنوعين من الأختام المعيبة:

  • الختم "المُشوِّه": تحاول بعض الطرق تغيير الوصفة قليلاً لإخفاء سر ما. على سبيل المثال، قد تجبر الذكاء الاصطناعي على اختيار كلمات مختلفة قليلاً عما كان سيختاره عادةً. هذا يشبه إضافة توابل غريبة إلى الخبز لتمييزه. هذا يعمل، لكن طعم الخبز يتغير (جودة النص تنخفض).
  • الختم "الهش": تحاول طرق أخرى إخفاء السر دون تغيير المذاق. لكنها تشبه الهمس في غرفة مزدحمة. إذا قام شخص ما بتعديل النص (أضاف جملة، أو حذف كلمة، أو أعاد صياغة الكلام)، فستضيع الهمسة، ولن تتمكن من إثبات أن الخبز ملكك بعد الآن.

2. حل MirrorMark: "الانعكاس المثالي"

MirrorMark هو طريقة جديدة لإخفاء رسالة سرية تكون خالية من التشويه (لا تغير المذاق) وقوية (تصمد أمام التعديل).

إنه يستخدم خدعة ذكية تسمى Mod-1 Mirroring.

  • التشبيه: تخيل أن الذكاء الاصطناعي يختار كلمة بناءً على رمية نرد تهبط في مكان ما بين 0 و 1.
  • الخدعة: بدلاً من تغيير رمية النرد، يأخذ MirrorMark هذا الرقم ويقوم "بطيه" فوق خط معين (مرآة) اعتماداً على الرسالة السرية التي يريد إرسالها.
  • السحر: إذا طويت ورقة بشكل مثالي، فإن شكل الورقة لا يتغير؛ بل يبدو مختلفاً فقط من الجانب الآخر. وبالمثل، يقوم MirrorMark بإعادة ترتيب الأرقام العشوائية التي يستخدمها الذكاء الاصطناعي، لكن النمط العام لتلك الأرقام يظل كما هو تماماً.
  • النتيجة: يكتب الذكاء الاصطناعي نصوصاً تبدو طبيعية وعالية الجودة بنسبة 100%، تماماً كما لو كانت بدون علامة مائية. ولكن مخبأ داخل الاختيارات المحددة للكلمات كود متعدد البتات (مثل بصمة رقمية) يمكن استعادته لاحقاً.

3. "المجدول المتوازن المرتبط بالسياق" (CABS)

حتى مع وجود مرآة مثالية، هناك خطر: ماذا لو قطع شخص ما جزءاً من النص؟ إذا كانت الرسالة السرية موزعة بشكل غير متساوٍ، فقد يؤدي قطع جزء منها إلى حذف الرسالة بأكملها.

يقدم MirrorMark مديراً ذكياً يسمى CABS (المجدول المتوازن المرتبط بالسياق).

  • التشبيه: تخيل أنك تخفي 100 ملاحظة صغيرة في كتاب طويل. إذا أخفيتهم جميعاً في الفصل الأول، فإذا مزق شخص ما ذلك الفصل، ستفقد كل شيء. إذا أخفيتهم بشكل عشوائي، فقد تتجمع الملاحظات معاً، مما يترك صفحات أخرى فارغة.
  • كيف يعمل CABS: يعمل CABS كأمين مكتبة حذر. ينظر إلى النص الذي يتم كتابته ويضمن توزيع الملاحظات السرية بالتساوي عبر الكتاب بأكمله.
  • شبكة الأمان: كما أنه ينشئ "إطارات" أو فصولاً. إذا مزق شخص ما صفحة، يضمن CABS أن الضرر يقتصر على ذلك الإطار الواحد فقط. يظل بقية الكتاب متزامناً، بحيث يمكن تجميع الرسالة المخفية مرة أخرى من الملاحظات المتبقية. هذا يجعل العلامة المائية صعبة التدمير للغاية أمام هجمات النسخ واللصق أو الحذف.

4. ما أظهرته التجارب

اختبر الباحثون MirrorMark مقابل طرق رائدة أخرى باستخدام نماذج ذكاء اصطناعي مثل LLaMA-2.

  • الجودة: كان النص الذي أنتجه MirrorMark لا يمكن تمييزه عن نص الذكاء الاصطناعي العادي. لم يبدُ آلياً أو غريباً.
  • الاكتشاف: كان من السهل اكتشاف MirrorMark أكثر من الطرق الأخرى. حتى مع كمية صغيرة من النص (300 كلمة)، استطاع تحديد المحتوى الذي يحمل العلامة المائية بدقة عالية.
  • القوة (المتانة): عندما حاول المهاجمون "كسر" العلامة المائية عن طريق حذف الكلمات، أو إضافة كلمات جديدة، أو نسخ ولصق أجزاء من النص، صمد MirrorMark بشكل أفضل بكثير من المنافسين.
  • السعة: يمكنه إخفاء الكثير من المعلومات (متعدد البتات)، وليس مجرد إشارة بسيطة (نعم/لا). وهذا يعني أنه يمكنه حمل تفاصيل مثل "من صنع هذا؟" أو "متى تم صنعه؟".

ملخص

MirrorMark يشبه التوقيع الشبح. فهو لا يترك علامة مرئية على النص، ولا يغير نكهة الكلمات، ولا ينكسر إذا مزقت صفحة من الكتاب. إنه يستخدم "مرآة" رياضية لإخفاء كود معقد داخل العشوائية الطبيعية لكيفية تفكير الذكاء الاصطناعي، مما يضمن بقاء مخرجات الذكاء الاصطناعي عالية الجودة مع إمكانية تتبعها إلى مصدرها.

غارق في أبحاث مجالك؟

تصلك نشرة يومية بأحدث الأبحاث المطابقة لكلماتك البحثية المفتاحية — مع ملخصات تقنية، بلغتك.

جرّب Digest →