← أحدث الأبحاث
💻 computer science

Museum-grounded auditing reveals systematic form failures in AI-generated Chinese lacquerware

تقدم هذه الورقة إطار تدقيق قائم على المتاحف يسمى "الهلوسة الثقافية" لتقييم أعمال اللاكر الصينية (اللاكيه) المولدة بواسطة الذكاء الاصطناعي، كاشفةً أنه في حين تفشل المقاييس الآلية في اكتشاف أخطاء شكلية منهجية، فإن التحكيم البشري يؤكد وجود تناقضات كبيرة مع الأدلة التاريخية، لا سيما ضمن عائلات أشياء محددة مثل أكواب الأذن من عصر أسرتي تشين وهان.

المؤلفون الأصليون: Peng Yue, Jia Hou, Xiao Zhang, Qingfeng Zhang

نُشر 2026-10-04
📖 4 دقيقة قراءة☕ قراءة في استراحة قهوة

المؤلفون الأصليون: Peng Yue, Jia Hou, Xiao Zhang, Qingfeng Zhang

البحث الأصلي مرخَّص بموجب CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/). ✨ هذا شرح مولَّده بالذكاء الاصطناعي للبحث أدناه. لم يكتبه المؤلفون ولم يصادقوا عليه. وللتحقق من الدقة التقنية، يرجى الرجوع إلى البحث الأصلي. اقرأ إخلاء المسؤولية الكامل

في أروقة المتاحف الهادئة، تروي القطع قصصاً صمدت لقرون. فكوب من اللاكيه (الورنيش) يعود لأسرة هان ليس مجرد وعاء فحسب؛ بل هو نوع محدد من الأشياء بـشكل معلوم، وتاريخ معروف، ومجموعة من السمات الهيكلية التي يستخدمها الخبراء للتعرف عليه. واليوم، يستطيع الذكاء الاصطناعي إنشاء صور لهذه الكنوز القديمة، منتجاً صوراً تبدو جميلة ومقنعة للوهلة الأولى. ومع ذلك، برز نوع جديد من المشكلات؛ فبينما قد تبدو هذه الصور المولدة حاسوبياً واقعية، إلا أنها غالباً ما تحتوي على أخطاء تاريخية دقيقة تغفل عنها الفحوصات الحاسوبية القياسية. قد تنجح التكنولوجيا في ضبط اللون أو الشكل العام، لكنها تخفق في فهم القواعد المحددة التي تُعرّف ماهية القطعة الأثرية الحقيقية. هذه الفجوة بين "الظهور بمظهر واقعي" و"الدقة التاريخية" هي التحدي المركزي الذي يحاول الباحثون الآن حله، خاصة مع بدء المتاحف والأرشيفات الرقمية في الاعتماد على هذه الأدوات لمشاركة الثقافة مع الجمهور.

لقد وضع فريق من الباحثين هدفاً لاختبار ما إذا كان بإمكان الذكاء الاصطناعي توليد صور دقيقة للمصنوعات الخشبية المطلية باللاكيه (الورنيش الصيني)، وهو نوع من الخشب المزخرف والمغطى بعصارة الأشجار تم حرفته لآلاف السنين. لم يكتفوا بالسؤال عما إذا كانت الصور تبدو جميلة، بل تساءلوا عما إذا كانت الأشياء الموجودة في الصور هي بالفعل ما يدعي الحاسوب أنها عليه. ولتحقيق ذلك، أنشأوا 540 صورة لمصنوعات من اللاكيه من فترات تاريخية مختلفة، تتراوح من العصور القديمة إلى أسرة تشينغ. ثم أخضعوا هذه الصور لتدقيق صارم، مقارنين كل صورة منها بالسجلات المتحفية الحقيقية والأدلة الموثقة. كان الهدف هو العثور على "الهلوسات الثقافية"، وهو مصطلح يستخدمه الباحثون لوصف الحالة التي يقوم فيها الذكاء الاصطناعي، وبكل ثقة، بإنشاء كائن يتناقض مع الحقائق التاريخية المعروفة.

ركزت الدراسة على الشكل المادي للأشياء. وضع الباحثون قاعدة واضحة: إذا طلب "الأمر" (prompt) نوعاً معيناً من الأكواب، فيجب أن تتضمن الصورة المولدة السمات الهيكلية التي تُعرف ذلك الكوب. وإذا أظهرت الصورة كوباً كاملاً ولكنها افتقدت جزءاً جوهرياً يمتلكه كل نموذج حقيقي من ذلك النوع، فسيتم اعتبارها فشلاً. سمح هذا النهج لهم بالفصل بين الأخطاء الفنية البسيطة والأخطاء الجوهرية في هوية الشيء. ووجدوا أنه بينما كانت العديد من الصور متسقة مع التاريخ، إلا أن عدداً كبيراً منها احتوى على أخطاء منهجية. وفي حالة محددة تتعلق بالأكواب ذات الأذنين من فترتي تشين وتشينغ، كانت النتائج مذهلة؛ فمن بين 45 صورة تم توليدها لهذا النوع المحدد من الأكواب، تم رصد 45 صورة (أي جميعها) باعتبارها متناقضة لأنها افتقرت إلى الأذنين المميزتين اللتين تأخذان شكل الهلال وتُعرف بهما القطعة. في الواقع، عندما أعاد الباحثون تقييم هذه الصور مع خبير ثانٍ، تأكد أن كل واحدة من الـ 45 كانت تمثل فشلاً. لقد صنع الذكاء الاصطناعي وعاءً يبدو كالكوب، لكنه يفتقر إلى الميزة ذاتها التي تجعل منه "كوباً ذا أذنين".

بعيداً عن هذا الفشل المحدد، بحث الباحثون فيما إذا كانت بعض الإعدادات أو التعليمات المعطاة للذكاء الاصطناعي ستجعله أكثر عرضة للنجاح أو الفشل. اختبروا تكوينات مختلفة لمولدات الصور، وهي في الأساس نسخ مختلفة من البرمجيات، ووجدوا أن بعض النسخ كانت أفضل بكثير في تجنب هذه الأخطاء الهيكلية من غيرها. ومع ذلك، اكتشفوا أيضاً أن الرقم العشوائي المحدد المستخدم لبدء عملية التوليد لم يكن له تأثير موثوق أو قابل للتنبؤ به على النتيجة. يشير هذا إلى أن الأخطاء ليست مجرد خلل عشوائي، بل هي مرتبطة بكيفية بناء وتكوين البرنامج. كما نظرت الدراسة فيما إذا كانت البرامج الحاسوبية الآلية يمكنها رصد هذه الأخطاء بمفردها، ووجدت أن الأدوات الآلية الحالية لم تكن قوية بما يكفي لاستبدال الخبراء البشر؛ إذ لم تستطع هذه البرامج سوى التخمين الضعيف بشأن الصور الخاطئة، وغالباً ما فشلت في التمييز بين كائن دقيق تاريخياً وبين نسخة مزيفة مقنعة.

خلص الباحثون إلى أن التحدي الأكبر في استخدام الذكاء الاصطناعي للتراث الثقافي لا يكمن فقط في جعل الأشياء تبدو جيدة، بل في ضمان صحتها الواقعية. ووجدوا أنه بينما يسهل رصد وتأكيد الأخطاء الصارخة، مثل فقدان ميزة هيكلية محددة، فإن الخط الفاصل بين الصورة "غير الواضحة" والصورة "الخاطئة" غالباً ما يكون ضبابياً ويعتمد على الشخص الذي ينظر إليها. في دراستهم، وجدوا أنه عندما كانت الصور صعبة الرؤية أو ذات زوايا غامضة، اختلف الخبراء غالباً حول ما إذا كان يجب تصنيفها كفشل أو كمواد غير قابلة للتقييم. هذا الغموض يمثل عقبة رئيسية. تظهر الدراسة أنه بينما يمكن للذكاء الاصطناعي إنتاج صور تراثية معقولة، فإنه يفتقر حالياً إلى الفهم العميق لهوية الأشياء الذي يمتلكه الخبراء البشريون. ويرى الباحثون أن الطريقة الأكثر موثوقية لضمان الدقة هي إبقاء المتاحف وسجلاتها الموثقة في قلب العملية، واستخدامها كمعيار نهائي يجب قياس كل صورة مولدة وفقاً له. فبدون هذا الأساس، تخاطر التكنولوجيا بخلق عالم من القطع الأثرية الجميلة ولكن الزائفة تاريخياً.

غارق في أبحاث مجالك؟

تصلك نشرة يومية بأحدث الأبحاث المطابقة لكلماتك البحثية المفتاحية — مع ملخصات تقنية، بلغتك.

جرّب Digest →