Quality Assessment of Public Summary of Training Content for GPAI models required by AI Act Article 53(1)(d)
تقدم هذه الورقة إطار عمل قائماً على البحث لتقييم شفافية وفائدة ملخصات التدريب العامة المطلوبة بموجب قانون الذكاء الاصطناعي للاتحاد الأوروبي لنماذج الذكاء الاصطناعي للأغراض العامة، مع تطبيقه على خمسة ملخصات حالية لتحديد المشكلات وتوجيه المزودين والسلطات نحو إفصاحات ذات جودة أعلى.
البحث الأصلي مرخَّص بموجب CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). هذا شرح مولَّده بالذكاء الاصطناعي للبحث أدناه. لم يكتبه المؤلفون ولم يصادقوا عليه. وللتحقق من الدقة التقنية، يرجى الرجوع إلى البحث الأصلي. اقرأ إخلاء المسؤولية الكامل
تخيل أنك اشتريت للتو خلاطًا جديدًا وفخمًا. مكتوب على العلبة أنه "خلاط متعدد الأغراض"، لكن ليس لديك أدنى فكرة عن المكونات التي وُضعت في العصير الذي صنعه. هل استخدم فراولة عضوية؟ هل خلط بالخطأ ملعقة بلاستيكية؟ هل استخدم فاكهة سُرقت من حديقة أحد الجيران؟
في عالم الذكاء الاصطناعي، "الخلاط" هو نموذج الذكاء الاصطناعي (AI Model)، و"المكونات" هي البيانات (Data) المستخدمة لتدريبه.
قانون الاتحاد الأوروبي للذكاء الاصطناعي (AI Act) هو مجموعة جديدة من القواعد المصممة للتأكد من أن هذه الخلاطات آمنة وعادلة. تنص قاعدة محددة (المادة 53) على ما يلي: "يجب على شركات الذكاء الاصطناعي نشر 'ملخص عام' لمكوناتها". يتعين عليهم ملء نموذج محدد يخبر الجميع بالضبط ماهية البيانات التي استخدموها.
ومع ذلك، مجرد قيام شركة ما بملء النموذج لا يعني أنها قامت بعمل جيد. قد يكتبون "استخدمنا فاكهة" (عبارة غامضة للغاية)، أو قد يخفون حقيقة استخدامهم لملاعق بلاستيكية (سوء نية).
هذه الورقة البحثية تشبه "مفتش مراقبة الجودة" لقوائم المكونات تلك. لقد صمم المؤلفون نظام "تقرير درجات" لتقييم مدى التزام شركات الذكاء الاصطناعي بالقواعد.
🕵️♂️ المشكلة: "الصندوق الأسود" للذكاء الاصطناعي
في الوقت الحالي، تحتفظ العديد من شركات الذكاء الاصطناعي الكبرى بأسرار بيانات التدريب الخاصة بها. يريد الاتحاد الأوروبي تغيير ذلك لكي:
- الفنانون والكُتّاب: يمكنهم معرفة ما إذا تم استخدام أعمالهم دون إذن.
- الناس العاديون: يمكنهم فهم كيفية عمل الذكاء الاصطعي.
- المحامون: يمكنهم إنفاذ الحقوق إذا حدث شيء غير قانوني.
ولكن هناك عقبة: لقد أعطى الاتحاد الأوروبي للشركات نموذجًا لتعبئته، لكنه لم يحدد كيفية التحقق مما إذا كانت الإجابات جيدة بالفعل. الأمر يشبه إعطاء طالب ورقة اختبار ولكن بدون نموذج إجابة.
📝 الحل: إطار عمل "تقرير الدرجات"
قام المؤلفون (باحثون من جامعة ترينيتي كوليدج دبلن وموزيلا) ببناء إطار عمل لتقييم الجودة. فكر في هذا كقائمة مراجعة ضخمة تحتوي على 242 سؤالاً محددًا.
هم يحكمون على ملخصات شركات الذكاء الاصطناعي بناءً على شيئين رئيسيين:
الشفافية (اختبار "المصباح اليدوي"):
- هل المعلومات واضحة؟
- هل هي كاملة، أم أن بها ثغرات؟
- هل هي متسقة (هل تتغير القصة في منتصف الطريق)؟
- التشبيه: إذا سلطت مصباحًا يدويًا على المستند، هل يمكنك رؤية كل شيء بوضوح، أم أنه ضبابي وغير واضح؟
الفائدة (اختبار "الأداة"):
- هل يمكن للشخص العادي فعليًا استخدام هذه المعلومات لمعرفة ما إذا كان فنه قد سُرق؟
- هل المستند سهل العثور عليه وقراءته؟
- التشبيه: هل هذا المستند عبارة عن مفك براغي يعمل، أم أنه قطعة بلاستيك تشبه مفك البراغي ولكنها لا تدير أي براغي؟
📊 النتائج: من نجح؟ ومن رسب؟
اختبر الباحثون 5 نماذج ذكاء اصطناعي كانت قد نشرت ملخصاتها (حتى أوائل عام 2026). إليكم كيف كان أداؤهم:
- 🏆 الطلاب المتفوقون (Apertus & Bria): ملأت هذه الشركات النموذج بشكل مثالي تقريبًا. كانوا واضحين، صادقين، وسهلين في الفهم. حصلت تقاريرهم على درجة A أو A+.
- 👍 طلاب المستوى (B) (SmolLM & Bielik): كانوا جيدين، ولكن كان لديهم بعض التفاصيل الناقصة أو الكتابة غير المنظمة. حصلوا على B+. لقد قاموا بالمهمة، لكن يمكنهم أن يكونوا أكثر دقة.
- 📉 الطالب الراسب (Phi-4 من Microsoft): كان هذا النموذج كارثيًا. كان المستند غامضًا، ويفتقر إلى أقسام ضخمة، ويقدم إجابات مثل "نحن نتبع القانون" بدلاً من سرد البيانات فعليًا. حصل على درجة D في الشفافية و F في الفائدة. كان الأمر أشبه بتقديم ورقة بيضاء مع ملاحظة لاصقة تقول "ثق بنا".
- 🚫 الطلاب الغائبون: لم تنشر عمالقة الذكاء الاصطناعي (Google، OpenAI، Meta) أي ملخصات بعد. لقد كانوا يتغيبون عن الفصل فعليًا.
🛠️ لماذا يهم هذا؟
يجادل المؤلفون بأنه إذا لم تكن لدينا ملخصات عالية الجودة، فإن القانون بأكمله سيكون بلا فائدة.
- إذا كان الملخص سيئًا، فلن يتمكن محامي حقوق النشر من إثبات أن الذكاء الاصطناعي سرق عمل موكله.
- إذا كان الملخص مخفيًا، فلن يعرف المواطن ما إذا كانت بياناته قد استُخدمت.
💡 الخلاصة
هذه الورقة لا تكتفي بتصحيح الواجبات المنزلية؛ بل تحاول إصلاح النظام بأكمله.
- لشركات الذكاء الاصطناعي: "توقفوا عن الكسل! املأوا النموذج بشكل صحيح، وإلا ستحصلون على درجة سيئة وربما غرامة مالية."
- للاتحاد الأوروبي: "يجب أن يكون النموذج أكثر وضوحًا، وربما ينبغي أن يكون لديكم موقع مركزي حيث تعيش كل هذه الملخصات، حتى لا يضطر الناس للبحث عنها كأنها كنز مفقود."
- لك أنت: "لقد بنينا موقعًا إلكتريًا عامًا حيث يمكنك رؤية هذه الدرجات. إذا كنت تريد معرفة ما إذا كان الذكاء الاصطناعي جديرًا بالثقة، فافحص تقرير درجاته أولاً."
باختصار: هذه الورقة هي بمثابة "Consumer Reports" (تقارير المستهلك) لبيانات تدريب الذكاء الاصطناعي. إنها هنا للتأكد من أن شركات الذكاء الاصطناعي لا تتظاهر بالشفافية فحسب، بل هي صادقة حقًا بشأن المكونات الموجودة في عصائرها الرقمية.
غارق في أبحاث مجالك؟
تصلك نشرة يومية بأحدث الأبحاث المطابقة لكلماتك البحثية المفتاحية — مع ملخصات تقنية، بلغتك.