LLM-Text Watermarking based on Lagrange Interpolation
تقترح هذه الورقة مخططاً قوياً لعلامة مائية نصية للنماذج اللغوية الكبيرة (LLM) تقوم بدمج هوية المؤلف كقيم تقابل إحداثيات مُولدة عشوائياً على خط مستقيم، مما يتيح استعادة معلومات المؤلف متعددة البتات حتى بعد الحذف العدائي الشديد من خلال حل مسألة النقاط المستقيمة أقصى ما يمكن (Maximum Collinear Points).
البحث الأصلي مرخَّص بموجب CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). هذا شرح مولَّده بالذكاء الاصطناعي للبحث أدناه. لم يكتبه المؤلفون ولم يصادقوا عليه. وللتحقق من الدقة التقنية، يرجى الرجوع إلى البحث الأصلي. اقرأ إخلاء المسؤولية الكامل
تخيل أن لديك قلماً سحرياً يمكنه كتابة قصص أو مقالات أو رسائل بريد إلكتروني مثالية. هذا القلم هو ذكاء اصطناعي (وتحديداً نموذج لغوي كبير). إنه بارع جداً في الكتابة لدرجة أنه أصبح من الصعب التمييز بين ما إذا كان بشراً هو من كتب القصة أم أن الذكاء الاصطناعي هو من فعل ذلك.
هذا يخلق مشكلة: كيف نعرف من (أو ما الذي) كتب النص؟ هل هو شخص حقيقي، أم روبوت يحاول نشر أخبار كاذبة أو سرقة الحقوق؟
لقد ابتكر مؤلفو هذه الورقة البحثية، ياروسلاف وباول ويوزيف، طريقة ذكية لـ إخفاء توقيع سري داخل كتابة الذكاء الاصطناعي. هم يسمونها "علامة مائية" (watermark)، ولكن بدلاً من كونها ختماً مرئياً، فهي نمط رياضي مخفي.
إليك كيف تعمل طريقتهم، مشروحة بتشبيهات بسيطة:
1. الوصفة السرية: رسم خط مستقيم
تخيل أن لديك أنت وصديقك شفرة سرية. قررتما أن توقيعكما السري هو خط مستقيم مرسوم على ورقة مربعات عملاقة.
- الخط يتبع قاعدة بسيطة: $y = ax + b$.
- الأرقام و هما مفتاحكما السري (العلامة المائية).
في العالم الحقيقي، لا يمكنك الرسم مباشرة على النص. لذا، يستخدم المؤلفون خدعة:
- يختارون نقاطاً عشوائية على ورقة المربعات (وهذه هي إحداثيات x).
- يحسبون أين يجب أن يكون الخط عند تلك النقاط (وهذه هي إحداثيات y).
- ثم يخفون هذه الإحداثيات داخل كتابة الذكاء الاصطناعي.
2. إخفاء الأدلة: رموز "الأخضر والأحمر"
كيف تخفي رقماً داخل جملة؟ تفعل ذلك عن طريق دفع خيارات الذكاء الاصطناعي بشكل طفيف.
تخيل أن الذكاء الاصطناعي على وشك كتابة الكلمة التالية. لديه قائمة تضم 50,000 كلمة محتملة يمكنه اختيارها.
- تقول الشفرة السرية: "في هذه اللحظة المحددة، إذا كان الرقم المخفي هو 0، فاختر كلمة من القائمة الحمراء. إذا كان 1، فاختر كلمة من القائمة الخضراء."
- الذكاء الاصطناعي لا يعرف أنه يفعل هذا؛ هو فقط يعتقد أنه يختار كلمة تناسب السياق. ولكن لأن المؤلفين "مالوا الكفة" (وجهوا الاحتمالات)، فإن الذكاء الاصطناعي أكثر عرضة لاختيار كلمة من القائمة الصحيحة.
من خلال القيام بذلك للعديد من الكلمات، يقومون بدمج سلسلة طويلة من الأصفار والآحاد التي، عند فك تشفيرها، تكشف إحداثيات النقاط على هذا الخط المستقيم السري.
3. عمل المحقق: إيجاد الخط
الآن، تخيل أن محققاً (المتحقق) استلم النص. هو لا يعرف الخط السري، لكن لديه المفتاح السري لإيجاد مواضع "x".
- إعادة البناء: ينظر إلى الكلمات، ويفك تشفير خيارات "الأخضر/الأحمر"، ويحصل على مجموعة من النقاط .
- المشكلة: نظرًا لأن الذكاء الاصطناعي عشوائي نوعاً ما، ولأن شخصاً سيئاً قد يحاول تعديل النص (حذف كلمات، تبديل كلمات)، فإن بعض هذه النقاط ستكون خاطئة. ستبدو مثل نقاط متناثرة في كل مكان على ورقة المربعات.
- الحل (الخدعة السحرية): يبحث المحقق عن أطول خط مستقيم يمر عبر أكبر عدد من النقاط.
- حتى لو كانت 50% من النقاط عبارة عن ضوضاء مشتتة (نقاط وهمية)، فإن الخط المستقيم الحقيقي سيظل يمتلك أكبر عدد من النقاط الواقعة عليه.
- تسمى هذه مشكلة "أقصى عدد من النقاط المستقيمة" (Maximum Collinear Points). إنها تشبه البحث عن أطول خط مستقيم من المراتب التي وضعها شخص ما بعناية وسط غرفة مليئة بالقصاصات الملونة (الكنفيتي).
بمجرد العثور على هذا الخط، يمكنهم قراءة المعادلة ($y = ax + bab$ هي العلامة المائية، وهي تثبت من كتب النص.
لماذا هذا مميز؟
- إنه قوي (متين): إذا حاول شخص سيئ تعديل النص (حذف فقرة، تغيير بعض الكلمات)، فقد يدمر بعض "النقاط". ولكن طالما بقيت بعض النقاط لتشكل الخط المستقيم، فإن العلامة المائية ستنجو. الأمر يشبه محاولة مسح خط مستقيم مرسوم على نافذة ضبابية؛ إذا مسحت بعض البقع، فسيظل الخط مرئياً.
- إنه سريع: إيجاد الخط هو مسألة رياضية يمكن للحواسيب حلها بسرعة كبيرة، حتى للنصوص الطويلة.
- إنه غير مرئي: النص لا يزال يُقرأ بشكل طبيعي تماماً. البشر لا يستطيعون ملاحظة الفرق.
تشبيه "اللغز المكسور"
فكر في النص كأنه لغز (Puzzle). لقد أخفى المؤلفون بعض قطع اللغز الخاصة التي، عند تجميعها، تشكل عصا مستقيمة.
- النص العادي: مجرد كومة من قطع اللغز العشوائية.
- النص المزود بعلامة مائية: كومة من القطع العشوائية، ولكن مع عصا مخفية مصنوعة من قطع خاصة.
- الهجوم: يحاول المخترق تحطيم اللغز أو تبديل القطع.
- الدفاع: حتى لو كسر المخترق اللغز، طالما أنه لم يكسر كل قطعة من العصا، يمكنك لاحقاً العثور على العصا وإثبات وجودها.
ملخص
تقترح هذه الورقة طريقة لختم نص الذكاء الاصطناعي بتوقيع "خط مستقيم" رياضي مخفي. وحتى لو حاول شخص ما تنظيف النص تماماً، فإن العلامة المائية قوية للغاية بحيث سيظل "الخط" بارزاً وسط الضجيج، مما يسمح لنا بإثبات: "نعم، هذا النص جاء من ذكاء اصطناعي، وإليك الدليل".
غارق في أبحاث مجالك؟
تصلك نشرة يومية بأحدث الأبحاث المطابقة لكلماتك البحثية المفتاحية — مع ملخصات تقنية، بلغتك.