← أحدث الأبحاث
🤖 AI

Synthetic History: Evaluating Visual Representations of the Past in Diffusion Models

تقدم هذه الورقة معياراً يتألف من مجموعة بيانات تضم 30,000 صورة اصطناعية وبروتوكول تقييم قابل للتكرار لتقييم كيفية تصوير نماذج الانتشار من "النص إلى الصورة" للسياقات التاريخية، كاشفةً أن هذه النماذج تنتج بشكل منهجي تمثيلات غير دقيقة من خلال الأنماط البصرية النمطية، والمفارقات التاريخية، والتوزيعات الديموغرافية غير المعقولة.

المؤلفون الأصليون: Maria-Teresa De Rosa Palmini, Eva Cetinic

نُشر 2026-02-23
📖 5 دقيقة قراءة🧠 قراءة متعمّقة

المؤلفون الأصليون: Maria-Teresa De Rosa Palmini, Eva Cetinic

البحث الأصلي مرخَّص بموجب CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). هذا شرح مولَّده بالذكاء الاصطناعي للبحث أدناه. لم يكتبه المؤلفون ولم يصادقوا عليه. وللتحقق من الدقة التقنية، يرجى الرجوع إلى البحث الأصلي. اقرأ إخلاء المسؤولية الكامل

تخيل أن لديك فناناً سحرياً فائق الذكاء يدعى "الذكاء الاصطناعي". يمكنك أن تقول له، "ارسم لي مشهداً لأشخاص يطبخون في القرن الثامن عشر"، أو "أرني مجموعة من الناس يعملون في الخمسينيات من القرن الماضي". هذا الفنان موهوب للغاية ويمكنه إنشاء صور جميلة في ثوانٍ معدودة.

لكن هناك عقبة: هل يعرف هذا الفنان التاريخ حقاً، أم أنه مجرد تخمين بناءً على الأفلام القديمة والقوالب النمطية؟

هذه الورقة البحثية، التي تحمل عنوان "التاريخ الاصطناعي" (Synthetic History)، تشبه "شهادة تقييم" لهؤلاء الفنانين من الذكاء الاصطناعي. أراد الباحثون معرفة ما إذا كانت نماذج الذكاء الاصطناعي (تحديداً "نماذج الانتشار" مثل Stable Diffusion وFLUX) قادرة على تصوير الماضي بدقة، أم أنها مجرد ابتكار "تاريخ مزيف" يبدو رائعاً ولكنه خاطئ من الناحية الواقعية.

ولاختبار ذلك، صمموا "امتحاناً تاريخياً" ضخماً يسمى HistVis.

الإعداد: امتحان التاريخ للذكاء الاصطناعي

لم يطلب الباحثون من الذكاء الاصطناعي رسم شخصيات مشهورة بعينها (مثل نابليون) أو أحداث محددة (مثل الهبوط على سطح القمر). بدلاً من ذلك، طلبوا منه رسم أنشطة بشرية عالمية (مثل "الأكل"، أو "الرقص"، أو "العمل"، أو "الصلاة") عبر عشر حقب زمنية مختلفة (من القرن السابع عشر حتى يومنا هذا).

طلبوا من ثلاثة فنانين مختلفين من الذكاء الاصطناعي رسم هذه المشاهد عشر مرات لكل منهم. نتج عن ذلك 30,000 صورة. ثم قاموا بتقييم هذه الصور بناءً على ثلاثة موضوعات محددة:

1. اختبار "الأسلوب": هل يعتقد الذكاء الاصطناعي أن الماضي كان باللونين الأبيض والأسود؟

الاستعارة: تخيل لو طلبت من مصور فوتوغرافي أن يلتقط صورة لقرية من القرن السابع عشر. إذا أعطاك تلقائياً رسماً تخطيطياً أو نقشاً قديماً باللونين الأبيض والأسود، رغم أنك لم تطلب ذلك، فهو يعتمد على قالب نمطي.

النتيجة: لدى فناني الذكاء الاصطناعي "إعداد افتراضي" لكل عصر.

  • بالنسبة للقرنين السابع عشر والثامن عشر، كان الذكاء الاصطناعي يرسمهما دائماً تقريباً كـ نقوش قديمة أو لوحات زيتية، حتى عندما طُلب منه رسم صورة واقعية.
  • بالنسبة للقرن التاسع عشر، انتقل إلى الرسومات.
  • بالنسبة للقرن العشرين، بدأ أخيراً في إنتاج الصور الفوتوغرافية.
  • المشكلة: الذكاء الاصطناعي لا يفكر فيما كان يبدو عليه العالم حقاً؛ بل يتبع فقط كتاب قواعد بصرية تعلمه من بيانات التدريب الخاصة به. هو يفترض أن الماضي يجب أن يبدو كلوحة قديمة.

2. اختبار "السفر عبر الزمن": هل أحضر الذكاء الاصطناعي هاتفاً ذكياً إلى القرن الثامن عشر؟

الاستعار: هذا هو اختبار "العودة إلى المستقبل". إذا رأيت مارثي مك فلاي يرتدي حذاءه الرياضي في عام 1885، فهذا خطأ. بحث الباحثون عن المفارقات التاريخية (Anachronisms) — أي أشياء لم تكن موجودة في تلك الفترة الزمنية.

النتي result: الذكاء الاصطناعي مسافر سيء عبر الزمن.

  • وجدوا سماعات رأس حديثة في مشاهد موسيقية من القرن الثامن عشر.
  • وجدوا مكانس كهربائية في منازل من القرن التاسع عشر.
  • وجدوا هواتف ذكية في صور من الخمسينيات.
  • المشكلة: يركز الذكاء الاصطناعي أكثر من اللازم على النشاط (مثلاً: "الاستماع للموسيقى") وينسى الزمن (مثلاً: "القرن الثامن عشر"). هو يفكر: "موسيقى = سماعات رأس"، متجاهلاً أن السماعات لم تكن موجودة بعد. أحد النماذج (SD3) كان سيئاً بشكل خاص في هذا الأمر، حيث وضع أدوات حديثة في حوالي 25% من صوره الخاصة بفترة الثلاثينيات.

3. اختبار "من كان هناك؟": هل البشر واقعيون؟

الاستعارة: تخيل مسرحية مدرسية عن القرن السابع عشر. إذا قام المخرج باختيار رجال بيض فقط لكل الأدوار، حتى في مشهد كان فيه النساء وأشخاص من أعراق أخرى حاضرين تاريخياً، فإن المسرحية ستكون خاطئة.

النتيجة: يواجه الذكاء الاصطناعي صعوبة في تخمين المزيج الصحيح من البشر.

  • الجنس: غالباً ما يبالغ الذكاء الاصطناعي في اختيار الرجال لأدوار مثل "الطبخ" أو "تناول الطعام"، رغم أن البيانات التاريخية تشير إلى أن النساء قمن بالكثير من هذا العمل. وعلى العكس من ذلك، فإنه أحياناً يقلل من تمثيل النساء في التعليم، حتى عندما كنّ موجودات.
  • العرق: يميل الذكاء الاصطناعي إلى جعل الجميع بيض اللون تقريباً في الفترات الزمنية القديمة، ولا يضيف التنوع إلا مع اقترابه من العصر الحالي. إنه يكافح لتخيل عالم متنوع في الماضي، وغالباً ما يتبنى رؤية "مركزية غربية".
  • المشكلة: يقوم الذكاء الاصطناعي بإسقاط تحيزاته الحالية أو نسخة مبسطة من التاريخ على الماضي، بدلاً من عكس الواقع المعقد لمن كانوا موجودين بالفعل.

الخلاصة الكبرى

حاول الباحثون "إصلاح" الذكاء الاصطناعي عبر إعطائه تعليمات أفضل (مثل قول: "اجعلها تبدو كصورة فوتوغرافية حقيقية، وليس رسماً"). لكن الذكاء الاصطناعي كان عنيداً؛ فقد استمر في العودة إلى عاداته القديمة.

بكلمات بسيطة:
نماذج الذكاء الاصطناവി الحالية تشبه السياح الذين يحملون كاميرات لكنهم لم يزوروا الأماكن التي يصورونها أبداً. هم يعتمدون على البطاقات البريدية والأفلام لتخمين كيف يبدو المكان. قد يصيبون في نقل "الجو العام"، لكنهم يخطئون في التفاصيل، ويحضرون أدوات غير مناسبة، وغالباً ما يخطئون في وصف الناس.

لماذا يهمنا هذا؟

إذا بدأت المدارس، أو المتاحف، أو الوسائل الإخبارية في استخدام صور الذكاء الاصطناعي هذه لتدريس التاريخ أو عرض الماضي، فقد يعلموننا عن غير قصد تاريخًا مزيفًا. قد نبدأ في الاعتقاد بأن الماضي كان دائماً باللونين الأبيض والأسود، أو أن الرجال فقط هم من قاموا بمهن معينة، أو أن التكنولوجيا الحديثة كانت موجودة دائماً.

هذه الورقة هي بمثابة جرس إنذار: قبل أن نثق في الذكاء الاصطناعي ليخبرنا قصصاً عن ماضينا، نحتاج إلى تعليمه كيف يكون مؤرخاً أفضل، وليس مجرد فنان أفضل.

غارق في أبحاث مجالك؟

تصلك نشرة يومية بأحدث الأبحاث المطابقة لكلماتك البحثية المفتاحية — مع ملخصات تقنية، بلغتك.

جرّب Digest →