From Wikipedia to AI: Measuring 25 years of synthesis of human genetics research in the public-facing information ecosystem
تحلل هذه الدراسة ٢٥ عاماً من مراجعات ويكيبيديا ومخرجات الذكاء الاصطناعي الناشئة لتكشف أن أبحاث الجينات البشرية تُدمج بشكل متكرر في المعلومات العامة حول العرق والجنسية، مع إظهار الموسوعات المولدة بواسطة الذكاء الاصطناعي وتيرة أعلى من المراجع الجينية وميلاً أكبر للهلوسة أو تحريف هذا البحث مقارنة بالمصادر التقليدية.
البحث الأصلي مرخَّص بموجب CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/). هذا شرح مولَّده بالذكاء الاصطناعي لبحث مسبق لم يخضع لمراجعة الأقران. وهو ليس نصيحة طبية. لا تتخذ أي قرارات تتعلق بصحتك بناءً على هذا المحتوى. اقرأ إخلاء المسؤولية الكامل
تخيل الجينوم البشري كأنه دليل التعليمات النهائي لبناء إنسان، مكتبة ضخمة من الشفرات التي أمضى العلماء عقوداً في فك رموزها. لكن الجزء الصعب هنا هو أن هذا الدليل لا يتحدث فقط عن العيون الزرقاء أو الشعر المجعد؛ بل غالباً ما يتداخل مع كيفية تعريفنا لمجموعات من البشر، مثل الأمم أو العرقيات أو الأجناس. فكر في الأمر ككتاب وصفات طعام اختلط بالخطأ بكتاب تاريخ. ولأن هذه المواضيع شخصية وسياسية للغاية، فمن السهل جداً أن يُحرف العلم أو يُفهم بشكل خاطئ عندما يقرأه عامة الناس. نحن جميعاً نعتمد على المعلومات العامة — مثل المواقع الإلكترونية التي نزورها أو برامج الدردشة الآلية التي نسألها للمساعدة في الواجبات المدرسية — لفهم هذا العلم المعقد. ولكن إذا كانت المعلومات الموجودة مشوشة قليلاً، أو إذا اخترعت حقائق لا وجود لها، فقد يؤدي ذلك إلى جعلنا نصدق أشياء عن بيولوجيتنا ليست حقيقية ببساطة. لهذا السبب، من المهم التحقق مما هو مكتوب بالفعل في هذه المساحات العامة ومعرفة ما إذا كان العلم يُروى بشكل صحيح.
تعمل هذه الورقة البحثية كقصة بوليسية لـ "محقق مسافر عبر الزمن"، تنظر إلى الوراء عبر 25 عاماً لترى كيف تم دمج أبحاث الوراثة البشرية في منظومة المعلومات العامة. قرر الباحثون أخذ لقطة ضخمة لويكيبيديا، الموسوعة الإلكترونية الأكثر شهرة في العالم، والتي يعاملونها كأنها جدارية ضخمة وحية يتم إعادة طلاء أجزائها ملايين المرات. لم يكتفوا بالنظر في صفحات قليلة؛ بل حللوا عدداً مذهلاً يصل إلى 3,050,422 مراجعة تاريخية من 6,738 صفحة مختلفة حول العرقية، والجنسية، والعرق.
ما وجدوه هو أن مصطلحات علم الوراثة قد تسللت بهدوء إلى 14.8% من هذه الصفحات، ولكن إذا قمت بالتكبير والتركيز على أهم 1,000 صفحة من حيث الشعبية، فإن هذا الرقم يقفز إلى 55.5%. يبدو الأمر كما لو أن أكثر من نصف القصص الشهيرة عن المجموعات الوطنية تتضمن الآن فصلاً بيولوجياً. وتحديداً، تذكر 67.8% من الصفحات المتعلقة بالجنسيات علم الوراثة، مما يشير إلى أن الأبحاث يتم دمجها لتقديم عنصر بيولوجي لفكرة العرقية والجنسية. كما ألقى المؤلفون نظرة خلف الكواليس على "صفحات النقاش"، حيث يتجادل المحررون حول ما يجب كتابته، ووجدوا أن 10.1% من أصل 56,908 نقاش هناك احتوت على مصطلحات وراثية.
القصة لا تتوقف عند ويكيبيديا. فقد سأل الفريق أيضاً ثلاثة من برامج الدردشة الآلية الشهيرة أسئلة حول الجنسيات، واكتشفوا أن مساعدي الذكاء الاصطناعي هؤلاء غالباً ما يشيرون إلى كل من علم الوراثة وويكيبيديا كمصادر لهم. لكن التحول الأكثر إثارة للدهشة يأتي من موسوعة جديدة مولدة بالذكاء الاصطناعي تسمى "جروكيبيديا" (Grokipedia). فعندما فحص الباحثون 133 صفحة من هذا المصدر الجديد، وجدوا أنه يذكر علم الوراثة بتكرار أكبر مما تفعل ويكيبيديا. ومع ذلك، وعلى عكس المحررين البشر الذين يحاولون توخي الحذر، وُجد أن هذه الموسوعة المولدة بالذكاء الاصطناعي تعاني من "الهلوسة" أو تسيء تمثيل أبحاث الوراثة البشرية، فهي تقوم أساساً باختراع حقائق أو تخطئ في العلم. تشير الورقة إلى أنه بينما نقوم بدمج المزيد من العلم في قصصنا العامة، نحتاج إلى توخي الحذر من أن يقوم رواة القصص الجدد من الذكاء الاصطناعي باختراع واقع بيولوجي لا وجود له.
غارق في أبحاث مجالك؟
تصلك نشرة يومية بأحدث الأبحاث المطابقة لكلماتك البحثية المفتاحية — مع ملخصات تقنية، بلغتك.