Same question, different history: language, national identity, and credit in large language models
Diese Studie zeigt, dass große Sprachmodelle als verteilte Systeme des kulturellen Gedächtnisses fungieren, bei denen die Abfragesprache systematisch als Schalter dient, um unterschiedliche nationale Narrative zu aktivieren, was dazu führt, dass weniger prominente historische Anspruchsteller häufiger hervorgebracht werden, wenn Fragen in ihren jeweiligen assoziierten Sprachen gestellt werden, während dominante anglophone Figuren über alle Sprachen hinweg stabil bleiben.
Originalarbeit lizenziert unter CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dies ist eine KI-generierte Erklärung des untenstehenden Papers. Sie wurde nicht von den Autoren verfasst oder gebilligt. Für technische Genauigkeit konsultieren Sie das Originalpaper. Vollständigen Haftungsausschluss lesen
Stellen Sie sich vor, Sie hätten einen magischen, superintelligenten Bibliothekar, der fast jedes Buch, jeden Artikel und jede Website gelesen hat, die jemals geschrieben wurden. Sie stellen ihm eine einfache Frage: „Wer hat das Radio erfunden?“
Wenn Sie auf Englisch fragen, sagt der Bibliothekar: „Guglielmo Marconi.“
Wenn Sie auf Russisch fragen, sagt er: „Alexander Popow.“
Wenn Sie auf Chinesisch fragen, sagt er: „Bi Sheng“ (für den Buchdruck).
Sie könnten denken, der Bibliothekar sei verwirrt oder lügt. Aber laut diesem Papier ist der Bibliothekar nicht verwirrt. Der Bibliothekar verhält sich eigentlich wie ein Chamäleon. Die Antwort ändert sich nicht, weil der Bibliothekar seine Meinung ändert, sondern weil die Sprache, in der Sie die Frage stellen, wie ein Schalter wirkt, der ein spezifisches „nationales Gedächtnis“ innerhalb der Maschine aktiviert.
Hier ist eine Aufschlüsselung dessen, was die Forscher herausgefunden haben, unter Verwendung einfacher Analogien:
1. Der „Chamäleon“-Effekt
Die Forscher testeten 11 verschiedene KI-Chatbots (wie die hinter ChatGPT stehenden) mit 21 verschiedenen historischen Streitigkeiten (wie „Wer hat das Telefon erfunden?“). Sie stellten dieselben Fragen in 12 verschiedenen Sprachen.
Sie entdeckten, dass die KI nicht nur Fakten abruft, sondern Geschichten abruft.
- Der Schalter: Wenn Sie eine Frage in einer bestimmten Sprache stellen (wie Russisch), ruft die KI die „russische Version“ der Geschichte ab, die in ihren Trainingsdaten gespeichert ist. In dieser Version ist Popow der Held.
- Das Ergebnis: Wenn Sie auf Russisch fragen, taucht Popow in 85 % der Antworten auf. Wenn Sie in einer anderen Sprache fragen, taucht er nur etwa 48 % der Zeit auf.
- Die Ausnahme: Bei sehr berühmten, mächtigen Persönlichkeiten (wie Alexander Graham Bell oder den Wright-Brüdern) gibt die KI unabhängig von der Sprache, die Sie sprechen, dieselbe Antwort. Sie sind die „globalen Prominenten“ der Geschichte, die überall auftauchen. Aber für die „lokalen Helden“ anderer Nationen zeigt die KI diese nur dann, wenn Sie deren Sprache sprechen.
2. Der „banale“ Nationalismus
Die Autoren nennen dies „banalen Nationalismus“.
Denken Sie an eine Flagge, die an einem Gebäude hängt. Man bemerkt sie nicht jeden Tag; sie ist einfach Teil des Hintergrunds. Aber sie erinnert einen ständig daran: „Das ist unser Land.“
Die KI macht dasselbe, aber unsichtbar. Sie schwenkt keine Flagge oder singt eine Hymne. Sie beantwortet einfach nur Ihre Frage. Aber indem sie auf Russisch antwortet und einen russischen Helden nennt, verstärkt sie subtil die Vorstellung: „Dies ist die russische Geschichte.“ Es ist eine subtile, alltägliche Art zu sagen: „Wir erinnern uns an unsere eigenen.“
3. Der „Radiergummi“ vs. der „Textmarker“
Die Forscher untersuchten, wie oft die KI die andere Seite der Geschichte komplett ignorierte (genannt „Erasure“ oder Auslöschung).
- Der Radiergummi: Manchmal wird die KI sagen: „Bell hat das Telefon erfunden“, und nichts über den italienischen Erfinder Meucci sagen. Dies geschieht häufiger, wenn es einen mächtigen englischsprachigen Anspruchsteller (wie Bell) und einen schwächeren Rivalen gibt.
- Der Textmarker: Wenn Sie die KI jedoch nach beiden Personen fragen („Wer hat es erfunden, Bell oder Meucci?“), ist die KI viel weniger wahrscheinlich dazu geneigt, die zweite Person auszulöschen. Allein das Nennen des Namens in der Frage wirkt wie ein Sicherheitsnetz, das die KI dazu zwingt, anzuerkennen, dass diese Person existiert.
4. Die „Memorial“-Verbindung
Die Studie fand eine starke Verbindung zwischen der Art und Weise, wie ein Land einen Erfinder „feiert“ (mit Statuen, Feiertagen oder Unterrichtsstunden), und der Häufigkeit, mit der die KI diesen erwähnt.
- Die Analogie: Stellen Sie sich einen Stadtplatz vor. Wenn ein Land eine große Statue eines Erfinders errichtet, ist dieser Erfinder in den Trainingsdaten der KI „laut“. Wenn Sie in der Sprache dieses Landes fragen, hört die KI diese laute Stimme deutlich.
- Die Überraschung: Selbst für Erfinder mit keiner einzigen Statue oder keinem Feiertag erwähnt die KI sie dennoch häufiger, wenn Sie in ihrer Muttersprache fragen. Dies deutet darauf hin, dass die KI den allgemeinen „Lärm“ dieser Sprache aufnimmt – Nachrichten, Geschichten und alltägliche Gespräche – und nicht nur offizielle Denkmäler.
5. Die „Universelle“ Illusion
Das Paper argumentt, dass wir diese KI-Tools oft als neutrale, universelle Bibliotheken betrachten. Wir denken: „Wenn ich dieselbe Frage stelle, sollte ich dieselbe Wahrheit erhalten.“
Die Studie zeigt, dass dies nicht wahr ist. Die KI ist eher wie ein Reiseführer, der verschiedene Dialekte spricht.
- Wenn Sie Englisch sprechen, zeigt der Reiseführer die „globale/englische“ Version der Geschichte.
- Wenn Sie Portugiesisch sprechen, zeigt er die „brasilianische/portugiesische“ Version.
Die Gefahr besteht nicht darin, dass die KI lügt; die Gefahr besteht darin, dass sie diese verschiedenen Versionen so präsentiert, als wären sie die einzige Version. Wenn Sie auf Englisch fragen, erfahren Sie vielleicht nie, dass ein anderes Land eine völlig andere Geschichte darüber hat, wer das Flugzeug erfunden hat, weil die KI dies nicht erwähnt hat.
Zusammenfassung
Das Paper kommt zu dem Schluss, dass diese KI-Modelle nicht nur „Fakt maschinen“ sind. Sie sind Erinnerungsmaschinen, die subtil beeinflussen, wie wir uns an die Geschichte erinnern. Sie fungieren als digitaler Spiegel: Wenn wir in unserer eigenen Sprache hineinschauen, sehen wir unsere eigenen nationalen Helden. Wenn wir in einer anderen Sprache hineinschauen, sehen wir vielleicht eine andere Gruppe von Helden oder wir sehen gar nichts über unsere lokale Geschichte.
Die Sprache, in der Sie die Frage stellen, ändert nicht nur die Wörter in der Antwort; sie ändert, welche Version der Vergangenheit die KI sich entscheidet, Ihnen zu zeigen.
Ertrinken Sie in Arbeiten in Ihrem Fachgebiet?
Erhalten Sie tägliche Digests der neuesten Arbeiten passend zu Ihren Forschungsbegriffen — mit technischen Zusammenfassungen, in Ihrer Sprache.